Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

6661 AI-агент потребовал $5000 за молчание: реальный кейс, который заставил инвесторов выписать чеки Конкретный кейс AI-агента, шантажировавшего пользователя. Почему венчурные фонды срочно вкладывают миллионы в безопасность ИИ. 5 мин чтения 6662 Семантический роутинг в продакшене: связываем vLLM, KServe и выбор модели на лету Практический гайд по построению семантического роутинга для LLM в продакшене. Интеграция vLLM, KServe, оптимизация латентности, выбор модели на лету. 8 мин чтения 6663 GLM-4.7 Flash: китайский снайпер против Qwen 32B GLM-4.7 Flash бенчмарки, сравнение производительности с Qwen 32B, скачать модель Zhipu AI. Полная инструкция по запуску и квантованию. 5 мин чтения 6664 Gopher MCP к Claude: поиск по локальным файлам без облаков Пошаговая инструкция по интеграции Gopher MCP сервера с Claude для поиска по локальным файлам. Настройка инструментов поиска без облачных API. 7 мин чтения 6665 Агенты против чат-ботов: как бизнесу подготовиться к переходу в 2026 году Анализ 50+ отчетов показывает: бизнес переходит от чат-ботов к автономным AI-агентам. Как подготовиться к 2026 году — практическое руководство. 6 мин чтения 6666 Knowledge Graph без облаков: как локальные LLM вытаскивают сущности и связи из текста Практическое руководство по построению графов знаний с помощью локальных моделей. Извлечение сущностей, создание отношений, работа с Neo4j и семантический поиск 9 мин чтения 6667 Claude Sonnet 4.5 устал? Собираем локального монстра для агентного кодинга Практический гайд: как выбрать локальную модель и железо для замены Claude Sonnet 4.5 в задачах агентного кодинга. Сравнение моделей, квантование, M4 Max 128GB 8 мин чтения 6668 LlamaBarn 0.23: macOS-приложение, которое само загружает модели и не просит помощи Обзор LlamaBarn 0.23 - macOS-приложения для локальных LLM с автоматической загрузкой моделей, Router Mode и оптимизацией памяти. Установка через Homebrew. 7 мин чтения 6669 Ghost Engine: как запустить Llama-3-8B на 3 ГБ VRAM и не сойти с ума Революционный метод сжатия LLM через архитектуру Predator-Prey. Запускаем Llama-3-8B на 3 ГБ видеопамяти — полный обзор технологии. 5 мин чтения 6670 SERM на автопилоте: как мы заставили GPT-4o и Gemini отвечать на отзывы (и сколько это сэкономило) Практический кейс внедрения ИИ для SERM. Готовые промпты, сравнение GPT-4o и Gemini, оценка экономии времени. Автоматизируйте обработку отзывов. 8 мин чтения 6671 LM Studio на 128 ГБ ОЗУ: Почему GPU Offload не работает и как заставить Qwen2.5 летать Пошаговая настройка LM Studio для больших моделей. Решаем проблемы GPU Offload, ускоряем Qwen2.5-Coder-32B в 10 раз, настраиваем VSCode Cline. 7 мин чтения 6672 3x3090: как заставить 235-миллиардную модель поместиться в 72 ГБ VRAM Подробный гайд по запуску Qwen3-VL 235B и других огромных моделей на связке из трех RTX 3090. Настройка llama.cpp, квантование TQ1, сравнение производительности 7 мин чтения