Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

1561 Графы знаний для юридического RAG: полный гайд по LightRAG и фреймворкам Полный гайд по построению юридического RAG на графах знаний. Разбор LightRAG, GraphRAG, HippoRAG и Ragex. Настройка, примеры кода, типичные ошибки. 8 мин чтения 1562 ByteDance выпустила 3B open-source модель: обзор возможностей и тесты производительности ByteDance представила 3B модель с впечатляющей производительностью для своего размера. Обзор возможностей, тесты и сравнение с аналогами. 5 мин чтения 1563 Найм джунов в 2026: от LeetCode к AI-дирижированию. Как рекрутеры переизобрели процесс за полгода Как изменился найм джуниоров за последние полгода: отказ от LeetCode, проверка промптов, AI-онбординг. Реальные кейсы компаний и советы HR-ам. 5 мин чтения 1564 95% кастомных GPT беззащитны: исследование 15 000 ботов вскрыло дыру в безопасности LLM Новое исследование показало: 95% кастомных GPT не имеют защиты, 96.51% поддаются roleplay-атакам. Почему AI-боты на LLM так уязвимы и что с этим делать? 5 мин чтения 1565 Как маленькая модель за $1000 обходит Llama 3.2 3B: разбор HRM-Text 1B Модель HRM-Text 1B обучена всего за $1000 на 40B токенов и превосходит Llama 3.2 3B в математике и понимании текста. Разбираем, как это стало возможным. 2 мин чтения 1566 Как использовать Pollux: LLM-судья для оценки русских языковых моделей [открытый код от Sber AI] Открытый инструмент Pollux от Sber AI для объективной оценки русскоязычных LLM. Разбор возможностей, примеры кода и сравнение с альтернативами. 5 мин чтения 1567 Почему LLM — это не просто предсказатели токенов: разбор интервью с Владимиром Крыловым Владимир Крылов о колмогоровской сложности, GRPO, DAPO и том, почему LLM всё-таки способны к пониманию. Разбор ключевых тезисов из интервью. 4 мин чтения 1568 Кастомная сборка llama.cpp для RDNA2: включаем flash attention и получаем 80 ток/с на Qwen3.6 35B Пошаговый гайд по сборке llama.cpp с flash attention для RDNA2. Тесты на Qwen3.6 35B показали прирост с 30 до 80 ток/с. Подходит для RX 6800/6900 XT. 6 мин чтения 1569 MTP в Qwen3.6-27B: почему многотокенное предсказание может вредить инструментальным агентам Многотокенное предсказание (MTP) ускоряет инференс, но ломает инструментальные вызовы. Почему acceptance rate падает на 30% и как это фиксить. 5 мин чтения 1570 Claude Code играет в OSU!: руководство по AI-взаимодействию с UI для автоматизации игр Научитесь использовать Claude Code для автоматизации игры OSU! через AI UI взаимодействие. Пошаговое руководство с примерами, кодом и разбором ошибок. 8 мин чтения 1571 Как дообучить NVIDIA Cosmos Predict 2.5 с LoRA/DoRA для генерации видео роботов: пошаговое руководство Пошаговый гайд по fine-tuning NVIDIA Cosmos Predict 2.5 с LoRA/DoRA для синтеза видео роботов. Подготовка данных, конфигурация, инференс. Ссылки на HuggingFace 9 мин чтения 1572 Почему ваш дешевый Claude Pro скоро превратится в тыкву: математика убытков OpenAI, Anthropic и Google Разбираем, почему Claude Pro за $20 — это финансовая пирамида. Реальные расчеты стоимости API, убытки лидеров AI и стратегия для бизнеса, чтобы не остаться у ра 6 мин чтения