Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

6541 GitHub DeepSeek просочился: загадочная ссылка 'model1' намекает на новый флагман Анализ обновления репозитория DeepSeek на GitHub. Что скрывает ссылка 'model1'? Возможный релиз новой модели, FlashMLA и спекуляции на январь 2026. 5 мин чтения 6542 ML-модель с сюрпризом: Как найти и обойти проверки безопасности на Hugging Face в 2026 Полный гайд по сканированию ML-моделей на вирусы и уязвимости. Обзор инструментов, техники обхода проверок и реальные примеры из практики. 9 мин чтения 6543 Бенчмарки врут: как 58% ошибок в датасетах HLE и GPQA искажают рейтинги LLM Новое исследование на 20.01.2026 выявило ~58% ошибок в популярных бенчмарках из-за плохого OCR. Как это ставит под сомнение все рейтинги LLM? 6 мин чтения 6544 Reasoning-v1: как использовать новый синтетический датасет для тонкой настройки LLM на логику (Apache 2.0) Обзор Dltha_Reasoning_v1 — синтетического датасета с цепочками рассуждений для улучшения логических способностей LLM. Лицензия Apache 2.0, примеры использования 6 мин чтения 6545 Ваша локальная LLM застряла на повторении? Вскрываем seed, temperature и top_p Почему локальная модель даёт одинаковые ответы? Полный гид по настройке параметров генерации в llama.cpp для разнообразия. 8 мин чтения 6546 KodaCode для JetBrains: русскоязычный AI-помощник против GitHub Copilot Обзор KodaCode — бесплатного AI-помощника для JetBrains IDE с поддержкой русского языка. Установка, настройка и честное сравнение с GitHub Copilot в 2026 году. 6 мин чтения 6547 Вайбкодинг с Claude Code и Codex: пошаговый пайплайн от спецификации до кода без потери лимитов Пошаговый гайд по созданию эффективного пайплайна для вайбкодинга с Claude Code и Codex. Учимся экономить токены и получать качественный код из спецификации. 9 мин чтения 6548 GLM-4.7-Flash в LM Studio: как остановить зацикливание и ускорить в 2 раза Пошаговая конфигурация GLM-4.7-Flash в LM Studio: исправляем зацикливание, ускоряем генерацию токенов, настраиваем temperature и repeat penalty. Актуально на ян 7 мин чтения 6549 Как создать модульную систему промптов для анализа договоров: практический гайд на примере YandexGPT Пошаговый гайд по созданию модульной системы промптов для анализа договоров на YandexGPT. Архитектура, примеры, решение проблемы галлюцинаций ИИ. 7 мин чтения 6550 Реранкеры для RAG: что выбрать в 2025? От Cohere до локальных вариантов на CPU Обзор реранкеров для RAG систем в 2025: Cohere, FlashRank, BGE-Reranker, Voyage, Jina. Таблицы сравнения, бенчмарки MTEB, локальные варианты на CPU. 6 мин чтения 6551 Мультиагентные системы: как мы превратили распределённый ИИ в монолит и что с этим делать Почему мультиагентные системы становятся распределёнными монолитами: архитектурные ошибки, A2A коммуникация и интеграционные тесты для агентов. 6 мин чтения 6552 RUL: Дообучение LLM на телефоне без облака — это реально. Исследование и рабочий код Практическое руководство по параметрически-эффективному дообучению языковых моделей на телефоне. Код, сравнение методов и пошаговый план для on-device training. 9 мин чтения