Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
6313
CPU-only MoE: как запустить 120B модели на DDR5 и не сойти с ума
Полное руководство по запуску MoE-моделей на CPU и DDR5. Расчёт скорости inference, настройка XMP/EXPO, выбор квантования Q4_K_M. Примеры для GLM-4.7-Flash, GPT
6314
Skills, MCP и сабагенты: как собрать AI-агента из LEGO в 2026 году
Полный гайд по архитектуре AI-агентов: Skills для знаний, MCP для инструментов, сабагенты для воркфлоу. Как собрать систему, которая не тупит и помнит всё.
6315
Почему AMD GPU медленнее в обрабатывает промпты: архитектурный разбор от софта до кремния
Глубокий разбор, почему AMD видеокарты тормозят с промптами. ROCm vs Vulkan, аппаратные ограничения RDNA, реальные цифры и можно ли это исправить в 2026 году.
6316
Эншитификация AI-сервисов: почему ваша подписка на GPT-5 становится всё хуже и что с этим делать
Почему облачные AI-сервисы ухудшаются, как распознать эншитификацию и какие локальные LLM выбрать для миграции в 2026 году. Полный гайд.
6317
Контекст-инжиниринг и Vibe Proving: что будет после того, как промпт-инжиниринг умрет
Продвинутые техники работы с LLM после промптов: контекст-инжиниринг, Vibe Proving, самоулучшающиеся workflow. Практическое руководство.
6318
Docker-среда для SAP-автоматизации: Клод, браузер и локальный AI в одном контейнере
Пошаговый гайд по созданию Docker-среды для автоматизации SAP с Claude Code, MCP плагинами и локальным vLLM. Рабочий стек на 2026 год.
6319
Конфиденциальность кода в облачных моделях: размывается ли ваша интеллектуальная собственность?
Как ваша интеллектуальная собственность растворяется в облачных AI моделях. Реальные риски для коммерческой разработки в 2026 году.
6320
Context Engine: Собираем гибридный поиск по коду, который не сливает ваши данные в облако
Настраиваем Context Engine — локальную систему гибридного поиска по коду с AST-парсингом и MCP-клиентом. Полная инструкция по развертыванию без отправки данных
6321
Эпистемическая калибровка: как DeepSeek и MiMo обманывают своей уверенностью
Практический гайд по оценке эпистемической калибровки LLM. Тестируем избыточную уверенность DeepSeek и MiMo с реальными примерами ошибок на 2026 год.
6322
LuxTTS: как клонировать голос локально за 1 секунду на слабом GPU
LuxTTS — легковесная диффузионная модель для клонирования голоса. Запускается на GPU с 1 ГБ VRAM, генерирует 150 секунд аудио в секунду. Полный обзор на 2026 го
6323
Pokemon Red на автопилоте: как собрать AI-агента на чистом браузере
Подробный гайд по созданию автономного AI-агента для Pokemon Red в браузере без серверов. WebLLM, TensorFlow.js и WASM-эмулятор на практике.
6324
Strix Halo против MiniMax-M2.1: Vulkan или ROCm? Q3_K_XL раскрывает все карты
Прямое сравнение Vulkan и ROCm бэкендов llama.cpp на AMD Strix Halo с 128GB RAM для MiniMax-M2.1 Q3_K_XL. Реальные цифры производительности за январь 2026.