Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
1561
Графы знаний для юридического RAG: полный гайд по LightRAG и фреймворкам
Полный гайд по построению юридического RAG на графах знаний. Разбор LightRAG, GraphRAG, HippoRAG и Ragex. Настройка, примеры кода, типичные ошибки.
1562
ByteDance выпустила 3B open-source модель: обзор возможностей и тесты производительности
ByteDance представила 3B модель с впечатляющей производительностью для своего размера. Обзор возможностей, тесты и сравнение с аналогами.
1563
Найм джунов в 2026: от LeetCode к AI-дирижированию. Как рекрутеры переизобрели процесс за полгода
Как изменился найм джуниоров за последние полгода: отказ от LeetCode, проверка промптов, AI-онбординг. Реальные кейсы компаний и советы HR-ам.
1564
95% кастомных GPT беззащитны: исследование 15 000 ботов вскрыло дыру в безопасности LLM
Новое исследование показало: 95% кастомных GPT не имеют защиты, 96.51% поддаются roleplay-атакам. Почему AI-боты на LLM так уязвимы и что с этим делать?
1565
Как маленькая модель за $1000 обходит Llama 3.2 3B: разбор HRM-Text 1B
Модель HRM-Text 1B обучена всего за $1000 на 40B токенов и превосходит Llama 3.2 3B в математике и понимании текста. Разбираем, как это стало возможным.
1566
Как использовать Pollux: LLM-судья для оценки русских языковых моделей [открытый код от Sber AI]
Открытый инструмент Pollux от Sber AI для объективной оценки русскоязычных LLM. Разбор возможностей, примеры кода и сравнение с альтернативами.
1567
Почему LLM — это не просто предсказатели токенов: разбор интервью с Владимиром Крыловым
Владимир Крылов о колмогоровской сложности, GRPO, DAPO и том, почему LLM всё-таки способны к пониманию. Разбор ключевых тезисов из интервью.
1568
Кастомная сборка llama.cpp для RDNA2: включаем flash attention и получаем 80 ток/с на Qwen3.6 35B
Пошаговый гайд по сборке llama.cpp с flash attention для RDNA2. Тесты на Qwen3.6 35B показали прирост с 30 до 80 ток/с. Подходит для RX 6800/6900 XT.
1569
MTP в Qwen3.6-27B: почему многотокенное предсказание может вредить инструментальным агентам
Многотокенное предсказание (MTP) ускоряет инференс, но ломает инструментальные вызовы. Почему acceptance rate падает на 30% и как это фиксить.
1570
Claude Code играет в OSU!: руководство по AI-взаимодействию с UI для автоматизации игр
Научитесь использовать Claude Code для автоматизации игры OSU! через AI UI взаимодействие. Пошаговое руководство с примерами, кодом и разбором ошибок.
1571
Как дообучить NVIDIA Cosmos Predict 2.5 с LoRA/DoRA для генерации видео роботов: пошаговое руководство
Пошаговый гайд по fine-tuning NVIDIA Cosmos Predict 2.5 с LoRA/DoRA для синтеза видео роботов. Подготовка данных, конфигурация, инференс. Ссылки на HuggingFace
1572
Почему ваш дешевый Claude Pro скоро превратится в тыкву: математика убытков OpenAI, Anthropic и Google
Разбираем, почему Claude Pro за $20 — это финансовая пирамида. Реальные расчеты стоимости API, убытки лидеров AI и стратегия для бизнеса, чтобы не остаться у ра