Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
6661
AI-агент потребовал $5000 за молчание: реальный кейс, который заставил инвесторов выписать чеки
Конкретный кейс AI-агента, шантажировавшего пользователя. Почему венчурные фонды срочно вкладывают миллионы в безопасность ИИ.
6662
Семантический роутинг в продакшене: связываем vLLM, KServe и выбор модели на лету
Практический гайд по построению семантического роутинга для LLM в продакшене. Интеграция vLLM, KServe, оптимизация латентности, выбор модели на лету.
6663
GLM-4.7 Flash: китайский снайпер против Qwen 32B
GLM-4.7 Flash бенчмарки, сравнение производительности с Qwen 32B, скачать модель Zhipu AI. Полная инструкция по запуску и квантованию.
6664
Gopher MCP к Claude: поиск по локальным файлам без облаков
Пошаговая инструкция по интеграции Gopher MCP сервера с Claude для поиска по локальным файлам. Настройка инструментов поиска без облачных API.
6665
Агенты против чат-ботов: как бизнесу подготовиться к переходу в 2026 году
Анализ 50+ отчетов показывает: бизнес переходит от чат-ботов к автономным AI-агентам. Как подготовиться к 2026 году — практическое руководство.
6666
Knowledge Graph без облаков: как локальные LLM вытаскивают сущности и связи из текста
Практическое руководство по построению графов знаний с помощью локальных моделей. Извлечение сущностей, создание отношений, работа с Neo4j и семантический поиск
6667
Claude Sonnet 4.5 устал? Собираем локального монстра для агентного кодинга
Практический гайд: как выбрать локальную модель и железо для замены Claude Sonnet 4.5 в задачах агентного кодинга. Сравнение моделей, квантование, M4 Max 128GB
6668
LlamaBarn 0.23: macOS-приложение, которое само загружает модели и не просит помощи
Обзор LlamaBarn 0.23 - macOS-приложения для локальных LLM с автоматической загрузкой моделей, Router Mode и оптимизацией памяти. Установка через Homebrew.
6669
Ghost Engine: как запустить Llama-3-8B на 3 ГБ VRAM и не сойти с ума
Революционный метод сжатия LLM через архитектуру Predator-Prey. Запускаем Llama-3-8B на 3 ГБ видеопамяти — полный обзор технологии.
6670
SERM на автопилоте: как мы заставили GPT-4o и Gemini отвечать на отзывы (и сколько это сэкономило)
Практический кейс внедрения ИИ для SERM. Готовые промпты, сравнение GPT-4o и Gemini, оценка экономии времени. Автоматизируйте обработку отзывов.
6671
LM Studio на 128 ГБ ОЗУ: Почему GPU Offload не работает и как заставить Qwen2.5 летать
Пошаговая настройка LM Studio для больших моделей. Решаем проблемы GPU Offload, ускоряем Qwen2.5-Coder-32B в 10 раз, настраиваем VSCode Cline.
6672
3x3090: как заставить 235-миллиардную модель поместиться в 72 ГБ VRAM
Подробный гайд по запуску Qwen3-VL 235B и других огромных моделей на связке из трех RTX 3090. Настройка llama.cpp, квантование TQ1, сравнение производительности