Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

6313 CPU-only MoE: как запустить 120B модели на DDR5 и не сойти с ума Полное руководство по запуску MoE-моделей на CPU и DDR5. Расчёт скорости inference, настройка XMP/EXPO, выбор квантования Q4_K_M. Примеры для GLM-4.7-Flash, GPT 10 мин чтения 6314 Skills, MCP и сабагенты: как собрать AI-агента из LEGO в 2026 году Полный гайд по архитектуре AI-агентов: Skills для знаний, MCP для инструментов, сабагенты для воркфлоу. Как собрать систему, которая не тупит и помнит всё. 9 мин чтения 6315 Почему AMD GPU медленнее в обрабатывает промпты: архитектурный разбор от софта до кремния Глубокий разбор, почему AMD видеокарты тормозят с промптами. ROCm vs Vulkan, аппаратные ограничения RDNA, реальные цифры и можно ли это исправить в 2026 году. 9 мин чтения 6316 Эншитификация AI-сервисов: почему ваша подписка на GPT-5 становится всё хуже и что с этим делать Почему облачные AI-сервисы ухудшаются, как распознать эншитификацию и какие локальные LLM выбрать для миграции в 2026 году. Полный гайд. 6 мин чтения 6317 Контекст-инжиниринг и Vibe Proving: что будет после того, как промпт-инжиниринг умрет Продвинутые техники работы с LLM после промптов: контекст-инжиниринг, Vibe Proving, самоулучшающиеся workflow. Практическое руководство. 7 мин чтения 6318 Docker-среда для SAP-автоматизации: Клод, браузер и локальный AI в одном контейнере Пошаговый гайд по созданию Docker-среды для автоматизации SAP с Claude Code, MCP плагинами и локальным vLLM. Рабочий стек на 2026 год. 8 мин чтения 6319 Конфиденциальность кода в облачных моделях: размывается ли ваша интеллектуальная собственность? Как ваша интеллектуальная собственность растворяется в облачных AI моделях. Реальные риски для коммерческой разработки в 2026 году. 5 мин чтения 6320 Context Engine: Собираем гибридный поиск по коду, который не сливает ваши данные в облако Настраиваем Context Engine — локальную систему гибридного поиска по коду с AST-парсингом и MCP-клиентом. Полная инструкция по развертыванию без отправки данных 9 мин чтения 6321 Эпистемическая калибровка: как DeepSeek и MiMo обманывают своей уверенностью Практический гайд по оценке эпистемической калибровки LLM. Тестируем избыточную уверенность DeepSeek и MiMo с реальными примерами ошибок на 2026 год. 10 мин чтения 6322 LuxTTS: как клонировать голос локально за 1 секунду на слабом GPU LuxTTS — легковесная диффузионная модель для клонирования голоса. Запускается на GPU с 1 ГБ VRAM, генерирует 150 секунд аудио в секунду. Полный обзор на 2026 го 4 мин чтения 6323 Pokemon Red на автопилоте: как собрать AI-агента на чистом браузере Подробный гайд по созданию автономного AI-агента для Pokemon Red в браузере без серверов. WebLLM, TensorFlow.js и WASM-эмулятор на практике. 7 мин чтения 6324 Strix Halo против MiniMax-M2.1: Vulkan или ROCm? Q3_K_XL раскрывает все карты Прямое сравнение Vulkan и ROCm бэкендов llama.cpp на AMD Strix Halo с 128GB RAM для MiniMax-M2.1 Q3_K_XL. Реальные цифры производительности за январь 2026. 5 мин чтения