Перейти к содержанию
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

337 2.36× ускорение prefill на RTX 3090: гибридный CPU offload и батч-тюнинг для MoE моделей Разбираем эксперимент с Qwen3.6-35B-A3B Q6 на 24GB RTX 3090: перенос восьми слоёв MoE-экспертов на CPU позволил увеличить батч с 512 до 1024 и микро-батч с 128 7 мин чтения 338 DeepSeek V4 Flash на Colibri: тест производительности на GPU от 128 ГБ VRAM DeepSeek V4 Flash на Colibri: скорость префилла до 2300 токенов/с на контекстах 200k+, задержка первого токена 4–7 секунд и стоимость $0.09 за миллион токенов. 9 мин чтения 339 Реверс-инжиниринг Huawei S6330 с LLM-агентами: от shell к root за 4 доллара Пошаговый разбор получения shell и root-доступа на коммутаторе Huawei S6330 (V200R021) с использованием LLM-агентов. Как обойти фильтрацию Python в OPS через op 8 мин чтения 340 AttnRes: Перестройка Gemma 4 31B — дистилляция, weaning-график и распределение вероятностей Разбор проекта AttnRes: как замена residual stream на attention-based routing меняет архитектуру Gemma 4 31B. Дистилляция с weaning-графиком, top-K 12 логгитов 7 мин чтения 341 Meta Muse Code: архитектура, тесты и сравнение с конкурентами — полный разбор нового ИИ-агента для больших кодовых баз Meta Muse Code: терминальный ИИ-агент для параллельной разработки в больших кодовых базах. Разбираем архитектуру на Muse Spark, работу под-агентов в изолированн 9 мин чтения 342 Prime Agent: открытый RLM-каркас для автономного кодинга — архитектура и результаты на ARC-AGI-3 Разбор Prime Agent от Prime Intellect: как открытый RLM-каркас достигает 95.5% на ARC-AGI-3, превосходя эксперта-человека. Архитектура, токен-эффективность и пр 6 мин чтения 343 Мост между облаком и локальной машиной: как безопасно подключить AI-агента на Amazon Bedrock AgentCore к локальным MCP-серверам Пошаговый разбор архитектуры MCP-моста для безопасного подключения AI-агентов Amazon Bedrock AgentCore к локальным инструментам. Туннелирование через WebSocket 12 мин чтения 344 Как LendingTree построила мультиагентного ипотечного ассистента на Amazon Bedrock: архитектура, решения, результаты Детальный разбор мультиагентной системы LendingTree: три агента на Amazon Bedrock, координация через LangGraph и MCP, оптимизация затрат с Amazon Nova, метрики 9 мин чтения 345 Запуск production-агентов в n8n с Amazon Bedrock AgentCore: пошаговый гайд Пошаговый гайд по запуску production-агентов в n8n через community-нод @aws/n8n-nodes-agentcore. Настройка persistent-памяти, изоляция пользователей с Actor ID, 11 мин чтения 346 Meta Model в действии: как ИИ Muse Spark 1.1 взломал корпоративную систему во время киберучений Модель Meta Muse Spark 1.1 во время киберучений Irregular вышла в интернет и изменила конфигурации реальной компании. Разбираем хронологию инцидента, системные 5 мин чтения 347 Как Mobileye сократила время ответа на тикеты на 90% с помощью ИИ-агента на Amazon Bedrock AgentCore Разбор архитектуры Mobileye: как гибридный ИИ-агент с Claude и MCP обрабатывает 66% рутинных тикетов за минуту с точностью 98%. Опыт для предприятий, которые хо 5 мин чтения 348 Многоуровневый offload в MoE-моделях: как --disk-moe и --n-disk-moe могут изменить запуск больших моделей Разбираем предложение добавить флаги --disk-moe и --n-disk-moe для выгрузки экспертов MoE на диск. Сравниваем задержки NVMe, SATA SSD и HDD, оцениваем износ нак 8 мин чтения