Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
6541
GitHub DeepSeek просочился: загадочная ссылка 'model1' намекает на новый флагман
Анализ обновления репозитория DeepSeek на GitHub. Что скрывает ссылка 'model1'? Возможный релиз новой модели, FlashMLA и спекуляции на январь 2026.
6542
ML-модель с сюрпризом: Как найти и обойти проверки безопасности на Hugging Face в 2026
Полный гайд по сканированию ML-моделей на вирусы и уязвимости. Обзор инструментов, техники обхода проверок и реальные примеры из практики.
6543
Бенчмарки врут: как 58% ошибок в датасетах HLE и GPQA искажают рейтинги LLM
Новое исследование на 20.01.2026 выявило ~58% ошибок в популярных бенчмарках из-за плохого OCR. Как это ставит под сомнение все рейтинги LLM?
6544
Reasoning-v1: как использовать новый синтетический датасет для тонкой настройки LLM на логику (Apache 2.0)
Обзор Dltha_Reasoning_v1 — синтетического датасета с цепочками рассуждений для улучшения логических способностей LLM. Лицензия Apache 2.0, примеры использования
6545
Ваша локальная LLM застряла на повторении? Вскрываем seed, temperature и top_p
Почему локальная модель даёт одинаковые ответы? Полный гид по настройке параметров генерации в llama.cpp для разнообразия.
6546
KodaCode для JetBrains: русскоязычный AI-помощник против GitHub Copilot
Обзор KodaCode — бесплатного AI-помощника для JetBrains IDE с поддержкой русского языка. Установка, настройка и честное сравнение с GitHub Copilot в 2026 году.
6547
Вайбкодинг с Claude Code и Codex: пошаговый пайплайн от спецификации до кода без потери лимитов
Пошаговый гайд по созданию эффективного пайплайна для вайбкодинга с Claude Code и Codex. Учимся экономить токены и получать качественный код из спецификации.
6548
GLM-4.7-Flash в LM Studio: как остановить зацикливание и ускорить в 2 раза
Пошаговая конфигурация GLM-4.7-Flash в LM Studio: исправляем зацикливание, ускоряем генерацию токенов, настраиваем temperature и repeat penalty. Актуально на ян
6549
Как создать модульную систему промптов для анализа договоров: практический гайд на примере YandexGPT
Пошаговый гайд по созданию модульной системы промптов для анализа договоров на YandexGPT. Архитектура, примеры, решение проблемы галлюцинаций ИИ.
6550
Реранкеры для RAG: что выбрать в 2025? От Cohere до локальных вариантов на CPU
Обзор реранкеров для RAG систем в 2025: Cohere, FlashRank, BGE-Reranker, Voyage, Jina. Таблицы сравнения, бенчмарки MTEB, локальные варианты на CPU.
6551
Мультиагентные системы: как мы превратили распределённый ИИ в монолит и что с этим делать
Почему мультиагентные системы становятся распределёнными монолитами: архитектурные ошибки, A2A коммуникация и интеграционные тесты для агентов.
6552
RUL: Дообучение LLM на телефоне без облака — это реально. Исследование и рабочий код
Практическое руководство по параметрически-эффективному дообучению языковых моделей на телефоне. Код, сравнение методов и пошаговый план для on-device training.