Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

2005 EMO — новая MoE-модель с эмерджентной модульностью: обзор архитектуры и как использовать 12.5% экспертов Разбираем архитектуру EMO от Allen AI: как модель сама выращивает модули из данных, почему достаточно 12.5% экспертов и как запустить веса с HuggingFace. 5 мин чтения 2006 Ring 2.6 1T: китайская Inclusion AI выкатила open-weight модель с триллионом параметров — уже на OpenRouter Open-weight модель Ring 2.6 1T от Inclusion AI доступна для тестирования на OpenRouter. Бесплатный доступ, 1 триллион параметров, открытые веса — что нужно знат 3 мин чтения 2007 Реалистичные бенчмарки для LLM: как тестировать модели с длинным контекстом и агентными сценариями Как тестировать LLM на длинном контексте и агентных задачах. Разбираем проблемы существующих бенчмарков, даем пошаговый план создания реалистичных тестов. 1 мин чтения 2008 z-lab взял Gemma 4 и выжал из неё DFlash: обзор, установка и первые впечатления Разбираем новое квантование DFlash для Gemma 4 26B: установка, тесты скорости, сравнение с IQ4_XS и Bartowski. Когда 4 активных миллиарда работают как 26. 4 мин чтения 2009 Hermes против OpenClaw: какой AI-агент выбрать? Детальное сравнение и критерии выбора Детальное сравнение Hermes Agent 4.2 и OpenClaw: производительность, стабильность, экономия токенов. Критерии выбора для разработчиков AI-агентов в 2026 году. 6 мин чтения 2010 Как ИИ-агенты помогли создать нетривиальную фичу для Ghostty: разбор процесса и стоимости токенов Реальный кейс: AI-агенты (Claude, GPT-4) написали функцию автообновления для терминала Ghostty за $0.20. Разбираем процесс, стоимость токенов и сравниваем с раб 5 мин чтения 2011 DS4: новый инференс-движок для DeepSeek 4 Flash на MacBook с 128GB – обзор и установка DS4 – специализированный движок для запуска DeepSeek 4 Flash на Mac с 128GB. Сравнение с MLX, llama.cpp, пошаговая установка и примеры использования. 6 мин чтения 2012 Создаём маркетинговый сайт без дизайнера: 5 практик с Open Design и Claude Code Соберите стильный лендинг за день без найма дизайнера. 5 проверенных практик с Open Design и Claude Code, актуальных на май 2026. 8 мин чтения 2013 Как построить централизованный AI Kit для нескольких продуктовых команд: опыт, цифры и грабли Реальный кейс: 8 команд, единый AI Kit, multi-agent CI-ревью, 47% acceptance rate, снижение времени review на 32% и цена $0.05 за PR. Грабли и решения для платф 7 мин чтения 2014 Быстрее молнии: тестируем MLX-AgentCore 2.0 — новый AI-движок для Apple Silicon, разгоняющий агентов до 600 ток/с Подробный обзор MLX-AgentCore 2.0 — быстрого локального AI-движка для Mac на Apple Silicon. Тесты производительности, сравнение с Ollama и vLLM-MLX, примеры аге 5 мин чтения 2015 Natural Language Autoencoders от Anthropic: как заглянуть в голову Gemma 3 Natural Language Autoencoders от Anthropic: декодируем внутренние состояния Gemma 3 в текст. Примеры, сравнение с альтернативами, инструкция по запуску. 6 мин чтения 2016 Skymizer HTX301: 384 ГБ памяти на одной PCIe-карте для локального LLM — прорыв или ниша? Обзор Skymizer HTX301 — PCIe инференс-карта с рекордными 384 ГБ HBM3. Сможет ли она заменить связки из нескольких RTX 4090? Анализ характеристик, цены и сценари 4 мин чтения