Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
5893
Kimi-k2.5 против Gemini 2.5 Pro: кто лучше в длинном контексте и как это меняет рынок
Технический разбор битвы моделей на 2 млн токенов. Kimi K2.5 догоняет Google по качеству, но дешевле в 3 раза. Что это значит для разработчиков в 2026 году.
5894
Как избежать ошибок в мульти-агентных системах: баланс количества, топологии и сложности задач
Практическое руководство по проектированию эффективных мульти-агентных систем. Разбираем типичные ошибки в количестве агентов, топологии взаимодействия и подбор
5895
Design Arena: как открытая модель захватила лидерство в дизайне и что это значит для будущего
В 2026 году open-source модель Design Arena захватывает лидерство в бенчмарках дизайна. Как это изменит рынок AI и что ждет проприетарные решения?
5896
Внутренний диалог: как грамматики ускоряют LLM в 3 раза и оживляют RPG-персонажей
Технический кейс: ускорение инференса LLM на 300% через грамматики, управление состоянием и внутренние голоса персонажей в RPG. Примеры кода, сравнение методов.
5897
QLoRA на RX 6600: как заставить RDNA2 работать там, где AMD сказала «нет»
Пошаговый гайд по запуску QLoRA на неподдерживаемых AMD GPU (RX 6600, RDNA2). Взлом ROCm, патчи ядра, работающие решения на 30.01.2026.
5898
Архитектура локальных агентов: как создать десктоп-агента с доступом к файлам и программам
Глубокий разбор архитектуры локальных AI-агентов. Как дать агенту доступ к файлам и программам на вашем компьютере без облака, сохранив контроль и приватность.
5899
Оптимальные локальные LLM для Mac M4/M5: сравнение GPT-OSS 20B и Gemma 4B для кодирования, администрирования и тегирования
Практическое сравнение GPT-OSS 20B и Gemma 4B для кодирования, администрирования и тегирования на Mac M4/M5. Гайд по выбору, настройке и оптимизации под Apple S
5900
Итоги сезона «ИИ в разработке» на Хабре: Qwen, Claude и Cursor в реальных боях
Анализ реального опыта разработчиков с ИИ: какие модели (Qwen, Claude, Cursor) используют на практике в 2026 году и какие задачи решают.
5901
ЛеКун в Давосе: «Китайские open-source модели лучше западных. И вот почему это больно»
Пионер ИИ Янн ЛеКун заявил в Давосе, что лучшие открытые модели создают в Китае. Разбираем его аргументы и последствия для Запада.
5902
Как Ozon отказался от векторного поиска (ANN) в пользу Query Prediction: архитектура ML-поиска для e-commerce
Глубокий разбор кейса Ozon: почему векторный поиск не справился с сотнями миллионов товаров и как Query Prediction улучшил релевантность. Архитектура, нюансы, о
5903
Профессор биологии создал multi-agent оркестратор для локальных LLM. И он работает лучше, чем ожидалось
Профессор биологии построил multi-agent систему с архитектурой planner-executor-critic для локальных LLM. Анализ работы, примеры и сравнение с альтернативами.
5904
RTX 6000, Halo Strix или DGX Spark: какую машину собрать для персонального ИИ-ассистента в 2026
Практическое руководство по сборке сервера для локальных LLM: RTX 6000, Halo Strix или DGX Spark. Что выбрать для кодинга и персонального ассистента в 2026.