Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
3337
Оптимизация serving massive MoE моделей: benchmark Qwen3.5-397B на 8x H20 с SGLang
Практическое руководство по оптимизации serving massive MoE моделей. Benchmark Qwen3.5-397B на 8x H20 с SGLang для экономии compute budget.
3338
История локальных LLM: от Llama до сегодня — хронология прорывов и ключевых релизов
Хронология развития локальных языковых моделей с 2023 по 2026 год. Как открытые модели изменили индустрию ИИ и что ждет в будущем.
3339
Как настроить vLLM для моделей Qwen3.5 на двух AMD Radeon 7900 XTX: секретные переменные окружения и бенчмарки
Полное руководство по запуску vLLM для Qwen3.5 на двух AMD RX 7900 XTX. Секретные флаги окружения, команды для бенчмаркинга и сравнение с llama.cpp. Актуально н
3340
Как исправить ошибку 'Failed to parse at pos' в llama.cpp: полное руководство по откату и патчу
Полное руководство по исправлению ошибки парсера в llama.cpp, включая откат коммита 34df42f7b, использование флага --skip-chat-parsing и ручной патч chat.cpp.
3341
Кризис стабильности llama.cpp: почему новая версия падает и как это исправить
Новая версия llama.cpp вызывает крэши и ошибки tool-calling. Разбираем причины, временные решения и когда ждать фикс. Актуально на 20 марта 2026.
3342
Доменные эмбеддинги за 24 часа: рецепт от NVIDIA, который не требует ни одного размеченного примера
Пошаговая инструкция по созданию доменных моделей эмбеддингов с синтетическими данными. Код, конфиги и разбор ошибок от NVIDIA.
3343
Как создать реалистичного ИИ-собеседника в стиле GenZ с задержками ответов
Полный гайд по созданию ИИ-собеседника в стиле GenZ. Асинхронность, задержки ответов, обработка прерываний, Sendblue API. Актуальные LLM на март 2026.
3344
REXASI-PRO: автономная коляска, которая не врежется в вашу тумбочку
Технологии лидаров, 3D-камер и ИИ в проекте REXASI-PRO. Как автономные коляски меняют жизнь людей с ограниченными возможностями в 2026 году.
3345
Секретные MoE-модели Microsoft: запускаем Phi-mini-MoE на ноутбуке с 8 ГБ ОЗУ
Пошаговый гайд: как найти и запустить скрытые MoE-модели Phi-mini-MoE и Phi-tiny-MoE от Microsoft на ноутбуке всего с 8 ГБ оперативной памяти.
3346
WordPress.com и AI-агенты: как автономно писать и публиковать посты через MCP
Узнайте, как AI-агенты через Model Context Protocol автоматически пишут и публикуют посты в WordPress.com. Новости и интеграции 2026 года.
3347
Как исправить Qwen3.5 35B: фикс зацикливания и перерасхода токенов через тонкую настройку
Пошаговый гайд по тонкой настройке Qwen3.5 35B. Убираем зацикливание, экономим до 70% токенов. Подготовка данных, выбор инструментов на 2026 год, разбор ошибок.
3348
Nemotron 3 Content Safety 4B: мультимодальная модерация контента от NVIDIA — обзор и применение
Обзор мультимодальной модели безопасности контента от NVIDIA для 2026 года: возможности, сравнение с альтернативами, сценарии использования для текста и изображ