Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
5725
Автоматическая настройка llama.cpp: как заставить AI-агента искать оптимальные параметры для любой модели
Пошаговый гайд по созданию AI-агента для автоматического бенчмаркинга и поиска лучших параметров llama.cpp под ваше железо. Экономьте часы ручной настройки.
5726
AniMUL-v1: 30 миллиардов параметров для распознавания животных по голосу. Полный гайд
Пошаговый туториал по работе с AniMUL-v1 — 30-миллиардной моделью для биоакустики. Установка, запуск, API, HuggingFace демо. Актуально на февраль 2026.
5727
MAVEN: как снизить галлюцинации LLM на 85% с помощью мульти-агентной верификации
Обзор MAVEN — open-source системы мульти-агентной верификации, которая снижает галлюцинации LLM на 85.3%. Установка, интеграция, сравнение с аналогами.
5728
AIDA: Ваш личный AI-хакер в Docker-контейнере с 400+ инструментами
Настройте автономного AI-агента для пентестинга с доступом к 400+ инструментам через Claude и MCP сервер в Docker Exegol. Полный гайд на 2026 год.
5729
Когда GPU-хостинг подводит: от отчаяния к системе (RunPod, Vast и другие под прицелом)
Полный гайд по диагностике проблем с GPU-хостами и выбору стабильного провайдера. Сравнение RunPod, Vast, чек-лист проверок, решение CUDA ошибок.
5730
mq: Как сократить расход токенов агентов на 83% с помощью утилиты для query-документов
Обзор инструмента mq для query-документов. Как сократить расход токенов AI-агентов на 83% без RAG. Работа с PDF, JSON, HTML через jq-подобный синтаксис.
5731
QAD от NVIDIA: Почему 4-битное квантование теперь работает и как применить его на практике
Подробный разбор QAD от NVIDIA: почему 4-битное квантование NVFP4 (E2M1) работает в 2026 году, сравнение с QAT/PTQ, практическое применение и настройка
5732
PocketCoder: зачем платить $120 за Claude Code, если можно собрать своего агента на Ollama
Обзор open-source PocketCoder: CLI-агент с долгосрочной памятью для кодинга на Ollama и OpenAI. Экономия $120/месяц. Архитектура, установка, примеры использован
5733
Локальные агентные AI: почему Cline и Goose не работают, как выбрать модель и не сойти с ума от вечных циклов
Практическое руководство по локальным агентным AI: сравнение Cline и Goose, выбор моделей (Qwen 3 Coder, GPT-OSS 20B), настройка MCP, решение проблем вечных цик
5734
RTX 6000 Pro 96GB: превращаем монстра памяти в машину для кодинга
Полное руководство по настройке рабочего процесса локального AI-кодинга на RTX 6000 Pro с 96 ГБ памяти. Инструменты, модели, стратегии.
5735
SDPO: революция в обучении с подкреплением через Self-Distillation — как это работает и где применять
Подробный разбор SDPO - нового метода обучения с подкреплением через Self-Distillation. Как улучшить LLM в 10 раз без данных. Сравнение с GRPO, RLVR, практическ
5736
Почему Gemma 3 GGUF тормозит и как это исправить за 5 минут
Подробный гайд по исправлению проблемы sliding_window в Gemma 3 GGUF через llama.cpp. Оптимизация скорости генерации, правильные флаги и сравнение производитель