Перейти к содержанию
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

301 ИИ-доказательство за 30 минут: как GPT-5.6 и Claude Fable 5 закрыли открытую задачу MIMO-детекции и что это значит для науки GPT-5.6 и Claude Fable 5 нашли доказательство для задачи MIMO-детекции, открытой с 2001 года, за 30 минут. Верификация заняла 5 дней — разбираем, почему проверк 6 мин чтения 302 Gemma 4.1: что ждать от августовского анонса — аудио, tool calling и не только Разбираем, какие улучшения в Gemma 4.1 ждут разработчики: унифицированный аудио-ввод для всех размеров, исправление tool calling, точность QAT с первого шага. О 7 мин чтения 303 Автоматизация цикла написания и ревью кода между Claude и Codex: разбор skill-подхода Skill для Claude Code автоматизирует цикл «написание — ревью — правки» между Claude и Codex. Разбор архитектуры из репозитория graph-engineer: как убрать ручное 6 мин чтения 304 Situational Awareness вкладывает $400 млн в Source Foundry: почему AI-фонд ставит на чипы, несмотря на потери AI-хедж-фонд Situational Awareness вложил $400 млн в Source Foundry, несмотря на сокращение активов вдвое. Разбираем логику ставки на чипы, технологию стэнфордс 7 мин чтения 305 Харнесс для ИИ-разработки: как два агента заменили команду и почему SDD стал новым стандартом Соло-разработчик создал Electron-продукт за 56 дней с помощью Claude Code и Codex. Разбираем устройство харнесса: спек-контракты, чистый контекст ревью и автома 10 мин чтения 306 KLQ: training-free квантизация LLM с waterfilling, которая обходит SpinQuant на W4A4KV4 KLQ — training-free метод квантизации LLM, который обходит SpinQuant на W4A4KV4 без градиентного обучения. Разбираем, как каузальные KL-возмущения и waterfillin 8 мин чтения 307 BigBang-v1: Реальные результаты финтюна Qwen 3.5 против гигантов — независимый тест Независимый тест BigBang-v1: финтюн Qwen 3.5 35B не дотягивает до заявленной производительности между DeepSeek Flash и Pro. Разбираем аномальный разброс на HLE 8 мин чтения 308 SupraElegans-500K: Рекуррентная модель без Transformer — архитектура, тесты и перспективы Разбираем архитектуру SupraElegans-500K — рекуррентной модели на 500K параметров без Transformer и KV-кэша. Бенчмарки HellaSwag 26.5%, ARC 21-22%, WinoGrande 52 7 мин чтения 309 Бюджетный домашний AI-сервер: 3x RX 9060 XT против 3x RTX 5060 Ti — выбираем платформу для LLM и MoE Собираем домашний AI-сервер с тремя GPU по 16 ГБ и бюджетом $3500. Сравниваем AMD RX 9060 XT и NVIDIA RTX 5060 Ti, платформы AM5 и б/у EPYC, разбираем влияние P 7 мин чтения 310 Сжатие LLM на 233 ГБ без потери точности: как удаление мультиязычности оптимизировало Kimi K3 Энтузиаст hellohazine сжал Kimi K3 с 711 до 478 ГБ, удалив все языки кроме английского. Точность на английском сохранилась, требования к GPU снизились на треть. 9 мин чтения 311 gitTalk: как нейросеть превращает естественный язык в Git-команды — опыт разработки на Go Утилита gitTalk конвертирует фразы на естественном языке в Git-команды через Gemini API. Разбор архитектуры на Go, строгий промпт для точных ответов модели и ре 7 мин чтения 312 OpenAI приобретает NextSlide: как стартап по созданию презентаций усилит ChatGPT OpenAI приобрела стартап NextSlide и интегрировала его команду в ChatGPT. Разбираем, как технология генерации презентаций изменит продукт, какие функции появятс 5 мин чтения