Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
301
ИИ-доказательство за 30 минут: как GPT-5.6 и Claude Fable 5 закрыли открытую задачу MIMO-детекции и что это значит для науки
GPT-5.6 и Claude Fable 5 нашли доказательство для задачи MIMO-детекции, открытой с 2001 года, за 30 минут. Верификация заняла 5 дней — разбираем, почему проверк
302
Gemma 4.1: что ждать от августовского анонса — аудио, tool calling и не только
Разбираем, какие улучшения в Gemma 4.1 ждут разработчики: унифицированный аудио-ввод для всех размеров, исправление tool calling, точность QAT с первого шага. О
303
Автоматизация цикла написания и ревью кода между Claude и Codex: разбор skill-подхода
Skill для Claude Code автоматизирует цикл «написание — ревью — правки» между Claude и Codex. Разбор архитектуры из репозитория graph-engineer: как убрать ручное
304
Situational Awareness вкладывает $400 млн в Source Foundry: почему AI-фонд ставит на чипы, несмотря на потери
AI-хедж-фонд Situational Awareness вложил $400 млн в Source Foundry, несмотря на сокращение активов вдвое. Разбираем логику ставки на чипы, технологию стэнфордс
305
Харнесс для ИИ-разработки: как два агента заменили команду и почему SDD стал новым стандартом
Соло-разработчик создал Electron-продукт за 56 дней с помощью Claude Code и Codex. Разбираем устройство харнесса: спек-контракты, чистый контекст ревью и автома
306
KLQ: training-free квантизация LLM с waterfilling, которая обходит SpinQuant на W4A4KV4
KLQ — training-free метод квантизации LLM, который обходит SpinQuant на W4A4KV4 без градиентного обучения. Разбираем, как каузальные KL-возмущения и waterfillin
307
BigBang-v1: Реальные результаты финтюна Qwen 3.5 против гигантов — независимый тест
Независимый тест BigBang-v1: финтюн Qwen 3.5 35B не дотягивает до заявленной производительности между DeepSeek Flash и Pro. Разбираем аномальный разброс на HLE
308
SupraElegans-500K: Рекуррентная модель без Transformer — архитектура, тесты и перспективы
Разбираем архитектуру SupraElegans-500K — рекуррентной модели на 500K параметров без Transformer и KV-кэша. Бенчмарки HellaSwag 26.5%, ARC 21-22%, WinoGrande 52
309
Бюджетный домашний AI-сервер: 3x RX 9060 XT против 3x RTX 5060 Ti — выбираем платформу для LLM и MoE
Собираем домашний AI-сервер с тремя GPU по 16 ГБ и бюджетом $3500. Сравниваем AMD RX 9060 XT и NVIDIA RTX 5060 Ti, платформы AM5 и б/у EPYC, разбираем влияние P
310
Сжатие LLM на 233 ГБ без потери точности: как удаление мультиязычности оптимизировало Kimi K3
Энтузиаст hellohazine сжал Kimi K3 с 711 до 478 ГБ, удалив все языки кроме английского. Точность на английском сохранилась, требования к GPU снизились на треть.
311
gitTalk: как нейросеть превращает естественный язык в Git-команды — опыт разработки на Go
Утилита gitTalk конвертирует фразы на естественном языке в Git-команды через Gemini API. Разбор архитектуры на Go, строгий промпт для точных ответов модели и ре
312
OpenAI приобретает NextSlide: как стартап по созданию презентаций усилит ChatGPT
OpenAI приобрела стартап NextSlide и интегрировала его команду в ChatGPT. Разбираем, как технология генерации презентаций изменит продукт, какие функции появятс