Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

2833 DGX Spark vs облачные B200: реальный кейс и экономия при обучении модели на 6B токенов Практический разбор обучения модели на 6B токенов: DGX Spark против облачных B200. Цифры производительности, стоимость, проблемы Triton и Mamba-2. 5 мин чтения 2834 Утечка Claude Mythos: как Anthropic скрывала модель с 10 триллионами параметров Скандальная утечка раскрывает Claude Mythos — модель Anthropic с 10 триллионами параметров, которую сочли слишком опасной для релиза. Факты на 01.04.2026. 4 мин чтения 2835 Holo3: SOTA-модель для автономной работы с компьютером. Обзор и инструкция по запуску Holo3 бьет рекорд на OSWorld (78.85%): обзор, сравнение с GPT-5.4, инструкция по запуску через Inference API. Открытые веса Apache2. 5 мин чтения 2836 Cognichip привлёк $60 млн: как ИИ проектирует чипы и почему это меняет всё Cognichip получил $60 млн на AI-дизайн чипов. Сокращение времени разработки на 75% меняет полупроводниковую индустрию. Подробности на 01.04.2026. 4 мин чтения 2837 Код Aider утек в сеть: когда AI-ассистент становится угрозой Скандальная утечка исходного кода AI-инструмента Aider. Как это повлияет на open-source сообщество и будущее проекта. Анализ на 01.04.2026. 4 мин чтения 2838 Как суммаризировать 'Войну и мир' на GPU с 10 ГБ памяти: практический гайд по квантованию и обработке длинных текстов Пошаговый гайд по суммаризации длинных текстов на GPU с 10 ГБ VRAM с помощью 4-битного квантования Saiga Llama 3 8B. Решение проблемы памяти и токенизации. 7 мин чтения 2839 Qwen 3.5 9B GGUF: практическое руководство по локальному извлечению данных из документов Полный гайд по настройке Qwen 3.5 9B GGUF для извлечения структурированных данных из финансовых и юридических документов на своём компьютере. Код, промпты, срав 7 мин чтения 2840 Как rotate activations в llama.cpp улучшает квантование: разбор метода и практическая настройка Полный разбор метода rotate activations в llama.cpp. Как вращение активаций повышает качество квантованных моделей. Практическая настройка и сравнение с альтерн 5 мин чтения 2841 Разбор утечки Claude Code: что внутри и какие ошибки безопасности повторять нельзя Анализ утечки исходного кода Claude Code от Anthropic. Что раскрыл sourcemap, архитектура CLI на TypeScript и уроки безопасности для AI-разработчиков на 01.04.2 4 мин чтения 2842 Darwin-35B-A3B-Opus: как работает техника Model MRI для слияния моделей и её установка Обзор Darwin-35B-A3B-Opus и техники Model MRI для слияния нейросетей. Установка, сравнение с альтернативами, примеры использования. 5 мин чтения 2843 Практический гайд: Qwen 3.5 для работы с реальными кодобазами — настройка, тесты и сравнение агентских возможностей Полный гайд по настройке Qwen 3.5 для работы с реальными кодобазами. Тесты производительности, сравнение агентских возможностей, оптимизация под Mac Mini. Работ 9 мин чтения 2844 TurboQuant TQ3_1S: как 3.5 бита спасают 16-гигабайтные видеокарты от Qwen3.5 Новый формат TQ3_1S в форке llama.cpp с CUDA. Запускаем Qwen3.5-27B на 16 ГБ VRAM. Сравнение потерь качества и гайд по установке на 01.04.2026. 5 мин чтения