Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

3337 Оптимизация serving massive MoE моделей: benchmark Qwen3.5-397B на 8x H20 с SGLang Практическое руководство по оптимизации serving massive MoE моделей. Benchmark Qwen3.5-397B на 8x H20 с SGLang для экономии compute budget. 7 мин чтения 3338 История локальных LLM: от Llama до сегодня — хронология прорывов и ключевых релизов Хронология развития локальных языковых моделей с 2023 по 2026 год. Как открытые модели изменили индустрию ИИ и что ждет в будущем. 4 мин чтения 3339 Как настроить vLLM для моделей Qwen3.5 на двух AMD Radeon 7900 XTX: секретные переменные окружения и бенчмарки Полное руководство по запуску vLLM для Qwen3.5 на двух AMD RX 7900 XTX. Секретные флаги окружения, команды для бенчмаркинга и сравнение с llama.cpp. Актуально н 5 мин чтения 3340 Как исправить ошибку 'Failed to parse at pos' в llama.cpp: полное руководство по откату и патчу Полное руководство по исправлению ошибки парсера в llama.cpp, включая откат коммита 34df42f7b, использование флага --skip-chat-parsing и ручной патч chat.cpp. 8 мин чтения 3341 Кризис стабильности llama.cpp: почему новая версия падает и как это исправить Новая версия llama.cpp вызывает крэши и ошибки tool-calling. Разбираем причины, временные решения и когда ждать фикс. Актуально на 20 марта 2026. 4 мин чтения 3342 Доменные эмбеддинги за 24 часа: рецепт от NVIDIA, который не требует ни одного размеченного примера Пошаговая инструкция по созданию доменных моделей эмбеддингов с синтетическими данными. Код, конфиги и разбор ошибок от NVIDIA. 9 мин чтения 3343 Как создать реалистичного ИИ-собеседника в стиле GenZ с задержками ответов Полный гайд по созданию ИИ-собеседника в стиле GenZ. Асинхронность, задержки ответов, обработка прерываний, Sendblue API. Актуальные LLM на март 2026. 9 мин чтения 3344 REXASI-PRO: автономная коляска, которая не врежется в вашу тумбочку Технологии лидаров, 3D-камер и ИИ в проекте REXASI-PRO. Как автономные коляски меняют жизнь людей с ограниченными возможностями в 2026 году. 7 мин чтения 3345 Секретные MoE-модели Microsoft: запускаем Phi-mini-MoE на ноутбуке с 8 ГБ ОЗУ Пошаговый гайд: как найти и запустить скрытые MoE-модели Phi-mini-MoE и Phi-tiny-MoE от Microsoft на ноутбуке всего с 8 ГБ оперативной памяти. 5 мин чтения 3346 WordPress.com и AI-агенты: как автономно писать и публиковать посты через MCP Узнайте, как AI-агенты через Model Context Protocol автоматически пишут и публикуют посты в WordPress.com. Новости и интеграции 2026 года. 3 мин чтения 3347 Как исправить Qwen3.5 35B: фикс зацикливания и перерасхода токенов через тонкую настройку Пошаговый гайд по тонкой настройке Qwen3.5 35B. Убираем зацикливание, экономим до 70% токенов. Подготовка данных, выбор инструментов на 2026 год, разбор ошибок. 7 мин чтения 3348 Nemotron 3 Content Safety 4B: мультимодальная модерация контента от NVIDIA — обзор и применение Обзор мультимодальной модели безопасности контента от NVIDIA для 2026 года: возможности, сравнение с альтернативами, сценарии использования для текста и изображ 7 мин чтения