Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
6469
Lemonade vs Ollama: кто победит в битве локальных LLM-серверов в 2026?
Полный обзор Lemonade и Ollama: поддержка GLM-4.7-Flash, ROCm, Vulkan, интеграция с LM Studio. Какой сервер выбрать в 2026 году для локального запуска LLM.
6470
Дистилляция навыков аудита безопасности в Qwen3-14B: тонкая настройка на трассах DeepSeek
Практическое руководство по дистилляции навыков аудита безопасности в Qwen3-14B. Тонкая настройка на трассах DeepSeek, снижение затрат на 70%, готовая модель на
6471
Структура против хаоса: почему Entity Cards бьют полный контекст в RAG-системах
F1-метрики, HotpotQA тесты и неожиданный вывод: Entity Cards на 37% эффективнее полного контекста для AI-агентов. Практическое руководство с кодом.
6472
128 ГБ ОЗУ на Strix Halo: какие модели для кодирования реально работают, а какие — маркетинг
Практический гайд по выбору моделей 30B-100B параметров для локального кодирования на Strix Halo с 128 ГБ ОЗУ. Сравнение GGUF, AWQ, тесты производительности, кв
6473
Гибридный AI-поиск по книгам: двухконтурная архитектура, векторизация метаданных и семантическое ранжирование на практике
Разбор кейса red_mad_robot: как построить гибридный поиск по 500k книг с двухконтурной архитектурой, векторизацией метаданных и LLM-ранжированием на практике в
6474
LLM забывают середину: как правильно сортировать списки от Bulk до TrueSkill
Почему LLM портят ранжирование длинных списков? Сравниваем 5 методов: от простого Bulk до алгоритма TrueSkill. Реальная задача с 164 постами.
6475
GLM 4.7 против Gemini 3: Битва за HTML5 Pacman — тест, промпты и неожиданный результат
Тестируем GLM 4.7 и Gemini 3 в создании клона Pacman на HTML5. Готовые промпты, настройки temperature=0, пошаговый разбор кода и неожиданный победитель. Сравнит
6476
Суверенный ИИ: почему $1.3 триллиона не решат проблему зависимости от глобальных цепочек
К 2026 году инвестиции в суверенный ИИ достигли $1.3 трлн, но страны все еще зависят от чипов, энергии и данных. Почему деньги не решают проблему?
6477
LLM как подчиненный: субъектный подход в архитектуре агентов
Продвинутый архитектурный паттерн: stateful ядро, логический слой и инверсия управления LLM. Решаем проблему стохастики моделей через субъектный подход.
6478
Арабский OCR 2026: полное тестирование VLM моделей, которые не умеют читать
Практическое сравнение VLM моделей для распознавания арабских документов. Gemini vs Qwen3-VL vs другие. Реальные результаты тестов, проблемы, выбор подходящей м
6479
KVzap: NVIDIA разогнала LLM в 4 раза, выкинув половину памяти
NVIDIA KVzap ускоряет инференс Llama 3.1 и Qwen3 в 2-4 раза через динамическое сжатие KV-кэша. Открытый код, установка, сравнение с альтернативами.
6480
Producer.ai vs Suno: тест-драйв нового сервиса от создателей Riffusion
Тестируем Producer.ai — новый сервис от создателей Riffusion. Сравнение с Suno, Udio, технические особенности и кому подойдет в 2026 году.