Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

5893 Kimi-k2.5 против Gemini 2.5 Pro: кто лучше в длинном контексте и как это меняет рынок Технический разбор битвы моделей на 2 млн токенов. Kimi K2.5 догоняет Google по качеству, но дешевле в 3 раза. Что это значит для разработчиков в 2026 году. 6 мин чтения 5894 Как избежать ошибок в мульти-агентных системах: баланс количества, топологии и сложности задач Практическое руководство по проектированию эффективных мульти-агентных систем. Разбираем типичные ошибки в количестве агентов, топологии взаимодействия и подбор 8 мин чтения 5895 Design Arena: как открытая модель захватила лидерство в дизайне и что это значит для будущего В 2026 году open-source модель Design Arena захватывает лидерство в бенчмарках дизайна. Как это изменит рынок AI и что ждет проприетарные решения? 5 мин чтения 5896 Внутренний диалог: как грамматики ускоряют LLM в 3 раза и оживляют RPG-персонажей Технический кейс: ускорение инференса LLM на 300% через грамматики, управление состоянием и внутренние голоса персонажей в RPG. Примеры кода, сравнение методов. 9 мин чтения 5897 QLoRA на RX 6600: как заставить RDNA2 работать там, где AMD сказала «нет» Пошаговый гайд по запуску QLoRA на неподдерживаемых AMD GPU (RX 6600, RDNA2). Взлом ROCm, патчи ядра, работающие решения на 30.01.2026. 7 мин чтения 5898 Архитектура локальных агентов: как создать десктоп-агента с доступом к файлам и программам Глубокий разбор архитектуры локальных AI-агентов. Как дать агенту доступ к файлам и программам на вашем компьютере без облака, сохранив контроль и приватность. 8 мин чтения 5899 Оптимальные локальные LLM для Mac M4/M5: сравнение GPT-OSS 20B и Gemma 4B для кодирования, администрирования и тегирования Практическое сравнение GPT-OSS 20B и Gemma 4B для кодирования, администрирования и тегирования на Mac M4/M5. Гайд по выбору, настройке и оптимизации под Apple S 7 мин чтения 5900 Итоги сезона «ИИ в разработке» на Хабре: Qwen, Claude и Cursor в реальных боях Анализ реального опыта разработчиков с ИИ: какие модели (Qwen, Claude, Cursor) используют на практике в 2026 году и какие задачи решают. 4 мин чтения 5901 ЛеКун в Давосе: «Китайские open-source модели лучше западных. И вот почему это больно» Пионер ИИ Янн ЛеКун заявил в Давосе, что лучшие открытые модели создают в Китае. Разбираем его аргументы и последствия для Запада. 5 мин чтения 5902 Как Ozon отказался от векторного поиска (ANN) в пользу Query Prediction: архитектура ML-поиска для e-commerce Глубокий разбор кейса Ozon: почему векторный поиск не справился с сотнями миллионов товаров и как Query Prediction улучшил релевантность. Архитектура, нюансы, о 9 мин чтения 5903 Профессор биологии создал multi-agent оркестратор для локальных LLM. И он работает лучше, чем ожидалось Профессор биологии построил multi-agent систему с архитектурой planner-executor-critic для локальных LLM. Анализ работы, примеры и сравнение с альтернативами. 6 мин чтения 5904 RTX 6000, Halo Strix или DGX Spark: какую машину собрать для персонального ИИ-ассистента в 2026 Практическое руководство по сборке сервера для локальных LLM: RTX 6000, Halo Strix или DGX Spark. Что выбрать для кодинга и персонального ассистента в 2026. 11 мин чтения