Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

5725 Автоматическая настройка llama.cpp: как заставить AI-агента искать оптимальные параметры для любой модели Пошаговый гайд по созданию AI-агента для автоматического бенчмаркинга и поиска лучших параметров llama.cpp под ваше железо. Экономьте часы ручной настройки. 8 мин чтения 5726 AniMUL-v1: 30 миллиардов параметров для распознавания животных по голосу. Полный гайд Пошаговый туториал по работе с AniMUL-v1 — 30-миллиардной моделью для биоакустики. Установка, запуск, API, HuggingFace демо. Актуально на февраль 2026. 11 мин чтения 5727 MAVEN: как снизить галлюцинации LLM на 85% с помощью мульти-агентной верификации Обзор MAVEN — open-source системы мульти-агентной верификации, которая снижает галлюцинации LLM на 85.3%. Установка, интеграция, сравнение с аналогами. 6 мин чтения 5728 AIDA: Ваш личный AI-хакер в Docker-контейнере с 400+ инструментами Настройте автономного AI-агента для пентестинга с доступом к 400+ инструментам через Claude и MCP сервер в Docker Exegol. Полный гайд на 2026 год. 9 мин чтения 5729 Когда GPU-хостинг подводит: от отчаяния к системе (RunPod, Vast и другие под прицелом) Полный гайд по диагностике проблем с GPU-хостами и выбору стабильного провайдера. Сравнение RunPod, Vast, чек-лист проверок, решение CUDA ошибок. 9 мин чтения 5730 mq: Как сократить расход токенов агентов на 83% с помощью утилиты для query-документов Обзор инструмента mq для query-документов. Как сократить расход токенов AI-агентов на 83% без RAG. Работа с PDF, JSON, HTML через jq-подобный синтаксис. 6 мин чтения 5731 QAD от NVIDIA: Почему 4-битное квантование теперь работает и как применить его на практике Подробный разбор QAD от NVIDIA: почему 4-битное квантование NVFP4 (E2M1) работает в 2026 году, сравнение с QAT/PTQ, практическое применение и настройка 9 мин чтения 5732 PocketCoder: зачем платить $120 за Claude Code, если можно собрать своего агента на Ollama Обзор open-source PocketCoder: CLI-агент с долгосрочной памятью для кодинга на Ollama и OpenAI. Экономия $120/месяц. Архитектура, установка, примеры использован 7 мин чтения 5733 Локальные агентные AI: почему Cline и Goose не работают, как выбрать модель и не сойти с ума от вечных циклов Практическое руководство по локальным агентным AI: сравнение Cline и Goose, выбор моделей (Qwen 3 Coder, GPT-OSS 20B), настройка MCP, решение проблем вечных цик 10 мин чтения 5734 RTX 6000 Pro 96GB: превращаем монстра памяти в машину для кодинга Полное руководство по настройке рабочего процесса локального AI-кодинга на RTX 6000 Pro с 96 ГБ памяти. Инструменты, модели, стратегии. 7 мин чтения 5735 SDPO: революция в обучении с подкреплением через Self-Distillation — как это работает и где применять Подробный разбор SDPO - нового метода обучения с подкреплением через Self-Distillation. Как улучшить LLM в 10 раз без данных. Сравнение с GRPO, RLVR, практическ 8 мин чтения 5736 Почему Gemma 3 GGUF тормозит и как это исправить за 5 минут Подробный гайд по исправлению проблемы sliding_window в Gemma 3 GGUF через llama.cpp. Оптимизация скорости генерации, правильные флаги и сравнение производитель 6 мин чтения