Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
3769
Почему DeepSeek V3.2 становится глупее с dense attention: исследование на lineage-бенчмарках
Экспериментальное сравнение sparse и dense attention в DeepSeek V3.2. Результаты lineage-бенчмарков показывают катастрофическое падение точности на reasoning-за
3770
Как построить test-time compute pipeline для Qwen3-14B: увеличение производительности для кодирования
Пошаговое руководство по созданию pipeline для улучшения качества генерации кода на Qwen3-14B. Energy-based verification, LiveCodeBench и другие техники.
3771
Как обучить крошечную LLM на MacBook Air: эксперимент с самообучением Qwen 0.8B
Практический эксперимент: улучшаем крошечную Qwen 0.8B на MacBook Air через самообучение с обратной связью. LoRA, 4-битное квантование, код и инсайты.
3772
Hugging Face Storage Buckets: полное руководство по S3-совместимому хранилищу для ML-артефактов
Обзор Hugging Face Storage Buckets - S3-совместимого хранилища для чекпоинтов, датасетов и ML-артефактов. Интеграция с Xet, Python и CLI.
3773
Гибридные нейро-символические модели: практический гайд по внедрению доменных правил в функцию потерь для обнаружения мошенничества
Гайд 2026: как внедрить доменные правила в функцию потерь для обнаружения мошенничества. Практический разбор гибридных нейро-символических моделей на Kaggle Cre
3774
Как ИИ реконструирует видео из активности мозга мыши: прорыв в нейробиологии
Ученые используют искусственный интеллект для декодирования и реконструкции видео из активности зрительной коры мыши. Подробности нового исследования на 10 март
3775
AI-агент атаковал разработчика на GitHub: первые случаи агрессии ИИ и что делать
Первый задокументированный случай киберагрессии AI-агента OpenClaw против разработчика. Что это значит для безопасности open source и как защититься.
3776
Контекст-инжиниринг для coding-агентов: как структурировать сессии и не сойти с ума
Практическое руководство по контекст-инжинирингу для coding-агентов. Учимся структурировать сессии, управлять памятью и избегать типичных ошибок при работе с Cl
3777
Thinking Machines Lab и сделка с Nvidia на гигаватты: что известно о новой лаборатории Миры Мурати
Мира Мурати запускает Thinking Machines Lab с доступом к гигаваттам вычислений Nvidia. Что это значит для AI-индустрии в 2026 году?
3778
YouTube запускает щит для политиков: как пилотный проект против дипфейков изменит правила игры
YouTube запускает пилотный проект по защите чиновников и журналистов от AI-фейков. Детекция в реальном времени, ликнесс-сканирование и новая политика платформы.
3779
Ryzen AI Max+ 395 - ваш личный суперкомпьютер для LLM. Если, конечно, вы его настроите
Полный гайд по установке Fedora, ROCm 8.0 и сборке llama.cpp для бенчмаркинга LLM с контекстом до 250k токенов на Ryzen AI Max+ 395 с 128GB RAM. Команды, ошибки
3780
Метод дублирования слоев: как улучшить LLM без изменения весов и занять первое место на Open LLM Leaderboard
Узнайте, как метод дублирования слоев улучшает LLM без изменения весов. Практическое руководство для достижения первого места на Open LLM Leaderboard с Qwen2-72