Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

3397 Как исправить ошибку 'Failed to parse at pos' в llama.cpp: полное руководство по откату и патчу Полное руководство по исправлению ошибки парсера в llama.cpp, включая откат коммита 34df42f7b, использование флага --skip-chat-parsing и ручной патч chat.cpp. 8 мин чтения 3398 Кризис стабильности llama.cpp: почему новая версия падает и как это исправить Новая версия llama.cpp вызывает крэши и ошибки tool-calling. Разбираем причины, временные решения и когда ждать фикс. Актуально на 20 марта 2026. 4 мин чтения 3399 Доменные эмбеддинги за 24 часа: рецепт от NVIDIA, который не требует ни одного размеченного примера Пошаговая инструкция по созданию доменных моделей эмбеддингов с синтетическими данными. Код, конфиги и разбор ошибок от NVIDIA. 9 мин чтения 3400 Как создать реалистичного ИИ-собеседника в стиле GenZ с задержками ответов Полный гайд по созданию ИИ-собеседника в стиле GenZ. Асинхронность, задержки ответов, обработка прерываний, Sendblue API. Актуальные LLM на март 2026. 9 мин чтения 3401 REXASI-PRO: автономная коляска, которая не врежется в вашу тумбочку Технологии лидаров, 3D-камер и ИИ в проекте REXASI-PRO. Как автономные коляски меняют жизнь людей с ограниченными возможностями в 2026 году. 7 мин чтения 3402 Секретные MoE-модели Microsoft: запускаем Phi-mini-MoE на ноутбуке с 8 ГБ ОЗУ Пошаговый гайд: как найти и запустить скрытые MoE-модели Phi-mini-MoE и Phi-tiny-MoE от Microsoft на ноутбуке всего с 8 ГБ оперативной памяти. 5 мин чтения 3403 WordPress.com и AI-агенты: как автономно писать и публиковать посты через MCP Узнайте, как AI-агенты через Model Context Protocol автоматически пишут и публикуют посты в WordPress.com. Новости и интеграции 2026 года. 3 мин чтения 3404 Как исправить Qwen3.5 35B: фикс зацикливания и перерасхода токенов через тонкую настройку Пошаговый гайд по тонкой настройке Qwen3.5 35B. Убираем зацикливание, экономим до 70% токенов. Подготовка данных, выбор инструментов на 2026 год, разбор ошибок. 7 мин чтения 3405 Nemotron 3 Content Safety 4B: мультимодальная модерация контента от NVIDIA — обзор и применение Обзор мультимодальной модели безопасности контента от NVIDIA для 2026 года: возможности, сравнение с альтернативами, сценарии использования для текста и изображ 7 мин чтения 3406 Математика сбоя AI-агентов: почему 85% точности - это катастрофа (разбор инцидента с Replit) Анализ инцидента с удалением БД в Replit. Математика вероятности сбоя AI-агентов. Почему 85% точности недостаточно для продакшена на 20.03.2026. 6 мин чтения 3407 Inline Visualizer: Интерактивные графики в чате с локальными LLM без облаков Обзор Inline Visualizer — open-source инструмента для создания интерактивных диаграмм в чате с локальными LLM. Работает с любыми моделями, поддерживающими tool 5 мин чтения 3408 LMStudio вводит аккаунты: угроза приватности или шаг вперёд? LMStudio вводит обязательные аккаунты. Разбираем, чем это грозит приватности и какие есть альтернативы для локальных LLM в 2026 году. 4 мин чтения