Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
6553
Когда фреймворки слишком сложны: 5 десктопных приложений для создания AI-агентов без кода
Обзор простых десктопных приложений для создания кастомных AI-агентов локально. LM Studio, Jan, Faraday и другие — без фреймворков и программирования.
6554
Локальный 'слой истины' для Claude Code: убиваем 90% галлюцинаций в терминале
Рабочий метод с Apidog CLI для детерминированной проверки API. Практический гайд по созданию локального слоя истины, который делает терминальных агентов предска
6555
HR-автоматизация 2026: как заставить LLM читать резюме вместо вас и не сойти с ума
Пошаговый разбор системы автоматического скрининга резюме на открытых LLM. От идеи до продакшена. Реальные метрики, код, ошибки и как их избежать.
6556
Open Cowork: Rust-версия Claude Cowork, которая не просит денег и не шпионит
Обзор и установка Open Cowork — self-hosted Rust-инструмента для AI-агентов с поддержкой Ollama, Docker и локальных моделей. Полная приватность, никаких подписо
6557
Coreness: YAML вместо Python, или Как развернуть 100 AI-ботов за вечер
Обзор Coreness: open-source фреймворк для развертывания AI-ботов через YAML-конфиги с встроенной RAG и изоляцией тенантов. Python, PostgreSQL RLS, multi-tenancy
6558
Искусственный интеллект пишет как человек: гайд по созданию экспертных статей, которые не отличишь от ручной работы
Практическое руководство по созданию качественных статей с помощью нейросетей. Узнайте, как обходить ИИ-детекторы, писать человеческие промпты и создавать уника
6559
Gonka: как заработать на децентрализованных AI-вычислениях, арендуя чужой GPU
Пошаговый гайд по запуску ноды Gonka для заработка на AI-вычислениях. Настройка, расчёт ROI, сравнение с облачными провайдерами на 2026 год.
6560
GLM 4.7 Flash: как отключить шизофрению в ответах и ускорить в 2 раза
Настройка температуры, top-k и отключение flash attention в llama.cpp для исправления некорректного вывода GLM 4.7 Flash. Практический гайд на январь 2026.
6561
Plano 0.4.3: Filter Chains и OpenRouter — модульные AI-агенты без головной боли
Обзор Plano 0.4.3: как Filter Chains и OpenRouter создают переиспользуемые AI-агенты. MCP, HTTP-фильтры, модульность без дублирования кода.
6562
Математика галлюцинаций ИИ: почему reasoning-модели ошибаются чаще и можно ли это исправить
Профессор математики объясняет фундаментальные причины галлюцинаций LLM в 2026. Почему reasoning-модели ошибаются чаще и можно ли это исправить.
6563
GLM-4.7-Flash: как компактная модель обходит гигантов в EQ-Bench и Judgemark
Компактная модель GLM-4.7-Flash показала сенсационные результаты в бенчмарках EQ-Bench и Judgemark, опередив крупные модели. Анализ для локального ИИ.
6564
Stop-First RAG: Как перестать платить за глупости, когда LLM нечего сказать
Обзор stop-first RAG - инструмента для экономии токенов в 2026. Открытый код на Python, автоматически пропускает вызов LLM, если нет релевантных данных.