Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

5509 VLLM против Llama.cpp против Ollama: битва движков для Open WebUI на RTX 3090 Экспертное сравнение VLLM, Llama.cpp и Ollama для Open WebUI на железе с RTX 3090. Реальные тесты, выбор движка под hot-swap моделей и многопользовательский дос 9 мин чтения 5510 Чего на самом деле не хватает в локальном AI: 7 проектов, которые ждут своих разработчиков Анализ реальных болей r/LocalLLaMA: какие инструменты нужны для локального AI в 2026 году. От RAG-систем до мобильных интерфейсов. 5 мин чтения 5511 Гонка гигантов: как OpenAI и Anthropic почти одновременно выпустили агентные модели для кодирования (GPT-5.3 Codex) Сравнение новых агентных моделей OpenAI GPT-5.3 Codex и Anthropic Agent для автономного программирования. Кто выиграл гонку на 05.02.2026? 4 мин чтения 5512 Maos AgentGate: как настроить CI/CD для AI-агентов и избежать регрессии в продакшене Обзор open-source инструмента Maos AgentGate для контроля качества AI-агентов в CI/CD. Настройка тестирования, сравнение с аналогами и примеры использования на 8 мин чтения 5513 Агенты на 16 ГБ VRAM: битва за контекст между Qwen3, Devstral и gpt-oss Практическое сравнение локальных моделей для агентов на 16 ГБ VRAM. Тесты скорости и качества Qwen3-4b-thinking, Devstral small 24B, gpt-oss-20B с длинным конте 9 мин чтения 5514 Интеграция MCP-клиента в llama.cpp: как превратить llama-cli в агента для кодинга Пошаговое руководство по интеграции Model Context Protocol в llama.cpp. Превращаем llama-cli в полноценного агента для кодинга с доступом к файлам, GitHub и IDE 6 мин чтения 5515 AI Bridge: как заставить Gemini управлять вашим компьютером через Python Пошаговая инструкция по созданию моста между Gemini и вашим компьютером. Автоматизируйте рутину с помощью Python и компьютерного зрения. 8 мин чтения 5516 Когда MoE-модели тормозят: оптимизируем llama.cpp для Qwen3-Coder-Next Гайд по оптимизации llama.cpp для MoE-моделей. Настройка параметров --fit, GPU-конфигурации и ускорение обработки промптов в Qwen3-Coder-Next на 40-60%. 8 мин чтения 5517 Ваш агент врёт как сивый мерин: как отловить галлюцинации в продакшн Практические методы борьбы с галлюцинациями AI-агентов в продакшн: верификация, кросс-чекинг, ограничение задач и мониторинг. Полное руководство на 2026 год. 9 мин чтения 5518 24hr-research-agent: как настроить автономную систему для создания книг с цитатами Настройте автономный research-агент для создания книг с цитатами. Обзор возможностей, сравнение с альтернативами и практические шаги на 2026 год. 6 мин чтения 5519 OpenAI Frontier против локальных агентов: корпоративный выбор или дорогая игрушка? Технический разбор OpenAI Frontier, CrewAI, Autogen. Что выбрать для бизнеса в 2026: облачные платформы или локальные решения? 5 мин чтения 5520 LightOnOCR-2 против GLM-OCR: кто выиграл гонку за распознавание текста в 2026? Подробный обзор и тестирование новых OCR-моделей LightOnOCR-2 и GLM-OCR. Сравнение скорости, точности, установки и примеры кода на Python. 6 мин чтения