Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
2005
EMO — новая MoE-модель с эмерджентной модульностью: обзор архитектуры и как использовать 12.5% экспертов
Разбираем архитектуру EMO от Allen AI: как модель сама выращивает модули из данных, почему достаточно 12.5% экспертов и как запустить веса с HuggingFace.
2006
Ring 2.6 1T: китайская Inclusion AI выкатила open-weight модель с триллионом параметров — уже на OpenRouter
Open-weight модель Ring 2.6 1T от Inclusion AI доступна для тестирования на OpenRouter. Бесплатный доступ, 1 триллион параметров, открытые веса — что нужно знат
2007
Реалистичные бенчмарки для LLM: как тестировать модели с длинным контекстом и агентными сценариями
Как тестировать LLM на длинном контексте и агентных задачах. Разбираем проблемы существующих бенчмарков, даем пошаговый план создания реалистичных тестов.
2008
z-lab взял Gemma 4 и выжал из неё DFlash: обзор, установка и первые впечатления
Разбираем новое квантование DFlash для Gemma 4 26B: установка, тесты скорости, сравнение с IQ4_XS и Bartowski. Когда 4 активных миллиарда работают как 26.
2009
Hermes против OpenClaw: какой AI-агент выбрать? Детальное сравнение и критерии выбора
Детальное сравнение Hermes Agent 4.2 и OpenClaw: производительность, стабильность, экономия токенов. Критерии выбора для разработчиков AI-агентов в 2026 году.
2010
Как ИИ-агенты помогли создать нетривиальную фичу для Ghostty: разбор процесса и стоимости токенов
Реальный кейс: AI-агенты (Claude, GPT-4) написали функцию автообновления для терминала Ghostty за $0.20. Разбираем процесс, стоимость токенов и сравниваем с раб
2011
DS4: новый инференс-движок для DeepSeek 4 Flash на MacBook с 128GB – обзор и установка
DS4 – специализированный движок для запуска DeepSeek 4 Flash на Mac с 128GB. Сравнение с MLX, llama.cpp, пошаговая установка и примеры использования.
2012
Создаём маркетинговый сайт без дизайнера: 5 практик с Open Design и Claude Code
Соберите стильный лендинг за день без найма дизайнера. 5 проверенных практик с Open Design и Claude Code, актуальных на май 2026.
2013
Как построить централизованный AI Kit для нескольких продуктовых команд: опыт, цифры и грабли
Реальный кейс: 8 команд, единый AI Kit, multi-agent CI-ревью, 47% acceptance rate, снижение времени review на 32% и цена $0.05 за PR. Грабли и решения для платф
2014
Быстрее молнии: тестируем MLX-AgentCore 2.0 — новый AI-движок для Apple Silicon, разгоняющий агентов до 600 ток/с
Подробный обзор MLX-AgentCore 2.0 — быстрого локального AI-движка для Mac на Apple Silicon. Тесты производительности, сравнение с Ollama и vLLM-MLX, примеры аге
2015
Natural Language Autoencoders от Anthropic: как заглянуть в голову Gemma 3
Natural Language Autoencoders от Anthropic: декодируем внутренние состояния Gemma 3 в текст. Примеры, сравнение с альтернативами, инструкция по запуску.
2016
Skymizer HTX301: 384 ГБ памяти на одной PCIe-карте для локального LLM — прорыв или ниша?
Обзор Skymizer HTX301 — PCIe инференс-карта с рекордными 384 ГБ HBM3. Сможет ли она заменить связки из нескольких RTX 4090? Анализ характеристик, цены и сценари