Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
3397
Как исправить ошибку 'Failed to parse at pos' в llama.cpp: полное руководство по откату и патчу
Полное руководство по исправлению ошибки парсера в llama.cpp, включая откат коммита 34df42f7b, использование флага --skip-chat-parsing и ручной патч chat.cpp.
3398
Кризис стабильности llama.cpp: почему новая версия падает и как это исправить
Новая версия llama.cpp вызывает крэши и ошибки tool-calling. Разбираем причины, временные решения и когда ждать фикс. Актуально на 20 марта 2026.
3399
Доменные эмбеддинги за 24 часа: рецепт от NVIDIA, который не требует ни одного размеченного примера
Пошаговая инструкция по созданию доменных моделей эмбеддингов с синтетическими данными. Код, конфиги и разбор ошибок от NVIDIA.
3400
Как создать реалистичного ИИ-собеседника в стиле GenZ с задержками ответов
Полный гайд по созданию ИИ-собеседника в стиле GenZ. Асинхронность, задержки ответов, обработка прерываний, Sendblue API. Актуальные LLM на март 2026.
3401
REXASI-PRO: автономная коляска, которая не врежется в вашу тумбочку
Технологии лидаров, 3D-камер и ИИ в проекте REXASI-PRO. Как автономные коляски меняют жизнь людей с ограниченными возможностями в 2026 году.
3402
Секретные MoE-модели Microsoft: запускаем Phi-mini-MoE на ноутбуке с 8 ГБ ОЗУ
Пошаговый гайд: как найти и запустить скрытые MoE-модели Phi-mini-MoE и Phi-tiny-MoE от Microsoft на ноутбуке всего с 8 ГБ оперативной памяти.
3403
WordPress.com и AI-агенты: как автономно писать и публиковать посты через MCP
Узнайте, как AI-агенты через Model Context Protocol автоматически пишут и публикуют посты в WordPress.com. Новости и интеграции 2026 года.
3404
Как исправить Qwen3.5 35B: фикс зацикливания и перерасхода токенов через тонкую настройку
Пошаговый гайд по тонкой настройке Qwen3.5 35B. Убираем зацикливание, экономим до 70% токенов. Подготовка данных, выбор инструментов на 2026 год, разбор ошибок.
3405
Nemotron 3 Content Safety 4B: мультимодальная модерация контента от NVIDIA — обзор и применение
Обзор мультимодальной модели безопасности контента от NVIDIA для 2026 года: возможности, сравнение с альтернативами, сценарии использования для текста и изображ
3406
Математика сбоя AI-агентов: почему 85% точности - это катастрофа (разбор инцидента с Replit)
Анализ инцидента с удалением БД в Replit. Математика вероятности сбоя AI-агентов. Почему 85% точности недостаточно для продакшена на 20.03.2026.
3407
Inline Visualizer: Интерактивные графики в чате с локальными LLM без облаков
Обзор Inline Visualizer — open-source инструмента для создания интерактивных диаграмм в чате с локальными LLM. Работает с любыми моделями, поддерживающими tool
3408
LMStudio вводит аккаунты: угроза приватности или шаг вперёд?
LMStudio вводит обязательные аккаунты. Разбираем, чем это грозит приватности и какие есть альтернативы для локальных LLM в 2026 году.