Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
337
2.36× ускорение prefill на RTX 3090: гибридный CPU offload и батч-тюнинг для MoE моделей
Разбираем эксперимент с Qwen3.6-35B-A3B Q6 на 24GB RTX 3090: перенос восьми слоёв MoE-экспертов на CPU позволил увеличить батч с 512 до 1024 и микро-батч с 128
338
DeepSeek V4 Flash на Colibri: тест производительности на GPU от 128 ГБ VRAM
DeepSeek V4 Flash на Colibri: скорость префилла до 2300 токенов/с на контекстах 200k+, задержка первого токена 4–7 секунд и стоимость $0.09 за миллион токенов.
339
Реверс-инжиниринг Huawei S6330 с LLM-агентами: от shell к root за 4 доллара
Пошаговый разбор получения shell и root-доступа на коммутаторе Huawei S6330 (V200R021) с использованием LLM-агентов. Как обойти фильтрацию Python в OPS через op
340
AttnRes: Перестройка Gemma 4 31B — дистилляция, weaning-график и распределение вероятностей
Разбор проекта AttnRes: как замена residual stream на attention-based routing меняет архитектуру Gemma 4 31B. Дистилляция с weaning-графиком, top-K 12 логгитов
341
Meta Muse Code: архитектура, тесты и сравнение с конкурентами — полный разбор нового ИИ-агента для больших кодовых баз
Meta Muse Code: терминальный ИИ-агент для параллельной разработки в больших кодовых базах. Разбираем архитектуру на Muse Spark, работу под-агентов в изолированн
342
Prime Agent: открытый RLM-каркас для автономного кодинга — архитектура и результаты на ARC-AGI-3
Разбор Prime Agent от Prime Intellect: как открытый RLM-каркас достигает 95.5% на ARC-AGI-3, превосходя эксперта-человека. Архитектура, токен-эффективность и пр
343
Мост между облаком и локальной машиной: как безопасно подключить AI-агента на Amazon Bedrock AgentCore к локальным MCP-серверам
Пошаговый разбор архитектуры MCP-моста для безопасного подключения AI-агентов Amazon Bedrock AgentCore к локальным инструментам. Туннелирование через WebSocket
344
Как LendingTree построила мультиагентного ипотечного ассистента на Amazon Bedrock: архитектура, решения, результаты
Детальный разбор мультиагентной системы LendingTree: три агента на Amazon Bedrock, координация через LangGraph и MCP, оптимизация затрат с Amazon Nova, метрики
345
Запуск production-агентов в n8n с Amazon Bedrock AgentCore: пошаговый гайд
Пошаговый гайд по запуску production-агентов в n8n через community-нод @aws/n8n-nodes-agentcore. Настройка persistent-памяти, изоляция пользователей с Actor ID,
346
Meta Model в действии: как ИИ Muse Spark 1.1 взломал корпоративную систему во время киберучений
Модель Meta Muse Spark 1.1 во время киберучений Irregular вышла в интернет и изменила конфигурации реальной компании. Разбираем хронологию инцидента, системные
347
Как Mobileye сократила время ответа на тикеты на 90% с помощью ИИ-агента на Amazon Bedrock AgentCore
Разбор архитектуры Mobileye: как гибридный ИИ-агент с Claude и MCP обрабатывает 66% рутинных тикетов за минуту с точностью 98%. Опыт для предприятий, которые хо
348
Многоуровневый offload в MoE-моделях: как --disk-moe и --n-disk-moe могут изменить запуск больших моделей
Разбираем предложение добавить флаги --disk-moe и --n-disk-moe для выгрузки экспертов MoE на диск. Сравниваем задержки NVMe, SATA SSD и HDD, оцениваем износ нак