Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

6469 Lemonade vs Ollama: кто победит в битве локальных LLM-серверов в 2026? Полный обзор Lemonade и Ollama: поддержка GLM-4.7-Flash, ROCm, Vulkan, интеграция с LM Studio. Какой сервер выбрать в 2026 году для локального запуска LLM. 6 мин чтения 6470 Дистилляция навыков аудита безопасности в Qwen3-14B: тонкая настройка на трассах DeepSeek Практическое руководство по дистилляции навыков аудита безопасности в Qwen3-14B. Тонкая настройка на трассах DeepSeek, снижение затрат на 70%, готовая модель на 9 мин чтения 6471 Структура против хаоса: почему Entity Cards бьют полный контекст в RAG-системах F1-метрики, HotpotQA тесты и неожиданный вывод: Entity Cards на 37% эффективнее полного контекста для AI-агентов. Практическое руководство с кодом. 7 мин чтения 6472 128 ГБ ОЗУ на Strix Halo: какие модели для кодирования реально работают, а какие — маркетинг Практический гайд по выбору моделей 30B-100B параметров для локального кодирования на Strix Halo с 128 ГБ ОЗУ. Сравнение GGUF, AWQ, тесты производительности, кв 10 мин чтения 6473 Гибридный AI-поиск по книгам: двухконтурная архитектура, векторизация метаданных и семантическое ранжирование на практике Разбор кейса red_mad_robot: как построить гибридный поиск по 500k книг с двухконтурной архитектурой, векторизацией метаданных и LLM-ранжированием на практике в 8 мин чтения 6474 LLM забывают середину: как правильно сортировать списки от Bulk до TrueSkill Почему LLM портят ранжирование длинных списков? Сравниваем 5 методов: от простого Bulk до алгоритма TrueSkill. Реальная задача с 164 постами. 11 мин чтения 6475 GLM 4.7 против Gemini 3: Битва за HTML5 Pacman — тест, промпты и неожиданный результат Тестируем GLM 4.7 и Gemini 3 в создании клона Pacman на HTML5. Готовые промпты, настройки temperature=0, пошаговый разбор кода и неожиданный победитель. Сравнит 8 мин чтения 6476 Суверенный ИИ: почему $1.3 триллиона не решат проблему зависимости от глобальных цепочек К 2026 году инвестиции в суверенный ИИ достигли $1.3 трлн, но страны все еще зависят от чипов, энергии и данных. Почему деньги не решают проблему? 5 мин чтения 6477 LLM как подчиненный: субъектный подход в архитектуре агентов Продвинутый архитектурный паттерн: stateful ядро, логический слой и инверсия управления LLM. Решаем проблему стохастики моделей через субъектный подход. 10 мин чтения 6478 Арабский OCR 2026: полное тестирование VLM моделей, которые не умеют читать Практическое сравнение VLM моделей для распознавания арабских документов. Gemini vs Qwen3-VL vs другие. Реальные результаты тестов, проблемы, выбор подходящей м 10 мин чтения 6479 KVzap: NVIDIA разогнала LLM в 4 раза, выкинув половину памяти NVIDIA KVzap ускоряет инференс Llama 3.1 и Qwen3 в 2-4 раза через динамическое сжатие KV-кэша. Открытый код, установка, сравнение с альтернативами. 6 мин чтения 6480 Producer.ai vs Suno: тест-драйв нового сервиса от создателей Riffusion Тестируем Producer.ai — новый сервис от создателей Riffusion. Сравнение с Suno, Udio, технические особенности и кому подойдет в 2026 году. 4 мин чтения