Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
25
Корпоративные ИИ-агенты: как работают виртуальные сотрудники внутри компании
Как ИИ-агенты работают внутри компании, чем отличаются от помощников, какие данные и инструменты им нужны и с каких процессов начинать запуск.
26
Почему квантование KV cache может ухудшать long-context в Qwen3.8-27B и что меняет режим on-write
Q8 KV cache в Qwen3.8-27B может ухудшать long-context из-за особенностей хранения и момента квантования. Разбираем разницу между on-write и пост-обработкой bf16
27
Как снизить нагрев домашнего AI-рига при локальном инференсе
Домашний AI-риг с двумя GPU может часами превращать электричество в тепло, даже если его характеристики далеки от серверных. Разбираем, как измерить реальную на
28
Переход топ-менеджера Meta в OpenAI: что означает назначение Сандхьи Деванатхан для рынка Азии
Разбираем заявленный переход Сандхьи Деванатхан из Meta в OpenAI, её предполагаемую роль в развитии бизнеса Юго-Восточной Азии и Австралии, а также планы регион
29
Как F16 KV-cache ускоряет Qwen 3.8 27B на двух Tesla P40 в llama.cpp
Разбираем, почему F16 KV-cache способен обогнать Q8 при запуске Qwen 3.8 27B на двух Tesla P40 в llama.cpp. В статье показаны связь с MTP и ngram-драфтом, роль
30
Судебный спор Anthropic и Пентагона о риске для цепочки поставок: что решил суд и что это меняет
Разбираем заявленный спор Anthropic и Пентагона: что может означать пометка риска для цепочки поставок, как работают аргументы о retaliation и Первой поправке,
31
Meta готовит Watermelon: что известно о следующей крупной AI-модели после Avocado
Watermelon пока остается кодовым именем предполагаемой следующей AI-модели Meta после Avocado. Разбираем сообщения о паузе pretraining, октябрьский горизонт рел
32
Как собрать полностью локальный медицинский RAG-ассистент на ноутбуке с 4 ГБ VRAM
Практическая схема локального медицинского RAG-ассистента для ноутбука с 4 ГБ VRAM: расчёт памяти, GGUF и mmap, корпус монографий, лёгкое переранжирование, аген
33
Почему Claude Code плохо оценивает сроки задач и как считать точнее
Claude Code часто выдаёт уверенную оценку, хотя в ней смешаны скорость агента, ручное ревью и неизвестные зависимости. Разбираем декомпозицию задач, калибровку
34
Как нейросети помогают инженерам проверять конструкторскую документацию
Практический разбор проверки конструкторской документации с помощью ИИ: комплектность КД, масса, материалы, спецификации, таблицы, сроки и стоимость. Разбираем
35
Почему суд в 2026 году признал незаконным внесение Anthropic в чёрный список Пентагона: проверка фактов
Громкое сообщение о конфликте Anthropic и Пентагона требует проверки по судебным и контрактным документам. Разбираем, какие факты пока не подтверждены, как могл
36
Как локально связать Qwen 3.8 27B с Blender 5.x через MCP для генерации 3D-сцен
Практический разбор связки Qwen 3.8 27B, Blender 5.x и MCP: роли компонентов, проверка VRAM и runtime, настройка blender-mcp и .mcp.json, а также пошаговый сцен