Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
2833
DGX Spark vs облачные B200: реальный кейс и экономия при обучении модели на 6B токенов
Практический разбор обучения модели на 6B токенов: DGX Spark против облачных B200. Цифры производительности, стоимость, проблемы Triton и Mamba-2.
2834
Утечка Claude Mythos: как Anthropic скрывала модель с 10 триллионами параметров
Скандальная утечка раскрывает Claude Mythos — модель Anthropic с 10 триллионами параметров, которую сочли слишком опасной для релиза. Факты на 01.04.2026.
2835
Holo3: SOTA-модель для автономной работы с компьютером. Обзор и инструкция по запуску
Holo3 бьет рекорд на OSWorld (78.85%): обзор, сравнение с GPT-5.4, инструкция по запуску через Inference API. Открытые веса Apache2.
2836
Cognichip привлёк $60 млн: как ИИ проектирует чипы и почему это меняет всё
Cognichip получил $60 млн на AI-дизайн чипов. Сокращение времени разработки на 75% меняет полупроводниковую индустрию. Подробности на 01.04.2026.
2837
Код Aider утек в сеть: когда AI-ассистент становится угрозой
Скандальная утечка исходного кода AI-инструмента Aider. Как это повлияет на open-source сообщество и будущее проекта. Анализ на 01.04.2026.
2838
Как суммаризировать 'Войну и мир' на GPU с 10 ГБ памяти: практический гайд по квантованию и обработке длинных текстов
Пошаговый гайд по суммаризации длинных текстов на GPU с 10 ГБ VRAM с помощью 4-битного квантования Saiga Llama 3 8B. Решение проблемы памяти и токенизации.
2839
Qwen 3.5 9B GGUF: практическое руководство по локальному извлечению данных из документов
Полный гайд по настройке Qwen 3.5 9B GGUF для извлечения структурированных данных из финансовых и юридических документов на своём компьютере. Код, промпты, срав
2840
Как rotate activations в llama.cpp улучшает квантование: разбор метода и практическая настройка
Полный разбор метода rotate activations в llama.cpp. Как вращение активаций повышает качество квантованных моделей. Практическая настройка и сравнение с альтерн
2841
Разбор утечки Claude Code: что внутри и какие ошибки безопасности повторять нельзя
Анализ утечки исходного кода Claude Code от Anthropic. Что раскрыл sourcemap, архитектура CLI на TypeScript и уроки безопасности для AI-разработчиков на 01.04.2
2842
Darwin-35B-A3B-Opus: как работает техника Model MRI для слияния моделей и её установка
Обзор Darwin-35B-A3B-Opus и техники Model MRI для слияния нейросетей. Установка, сравнение с альтернативами, примеры использования.
2843
Практический гайд: Qwen 3.5 для работы с реальными кодобазами — настройка, тесты и сравнение агентских возможностей
Полный гайд по настройке Qwen 3.5 для работы с реальными кодобазами. Тесты производительности, сравнение агентских возможностей, оптимизация под Mac Mini. Работ
2844
TurboQuant TQ3_1S: как 3.5 бита спасают 16-гигабайтные видеокарты от Qwen3.5
Новый формат TQ3_1S в форке llama.cpp с CUDA. Запускаем Qwen3.5-27B на 16 ГБ VRAM. Сравнение потерь качества и гайд по установке на 01.04.2026.