Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

3769 Почему DeepSeek V3.2 становится глупее с dense attention: исследование на lineage-бенчмарках Экспериментальное сравнение sparse и dense attention в DeepSeek V3.2. Результаты lineage-бенчмарков показывают катастрофическое падение точности на reasoning-за 5 мин чтения 3770 Как построить test-time compute pipeline для Qwen3-14B: увеличение производительности для кодирования Пошаговое руководство по созданию pipeline для улучшения качества генерации кода на Qwen3-14B. Energy-based verification, LiveCodeBench и другие техники. 11 мин чтения 3771 Как обучить крошечную LLM на MacBook Air: эксперимент с самообучением Qwen 0.8B Практический эксперимент: улучшаем крошечную Qwen 0.8B на MacBook Air через самообучение с обратной связью. LoRA, 4-битное квантование, код и инсайты. 10 мин чтения 3772 Hugging Face Storage Buckets: полное руководство по S3-совместимому хранилищу для ML-артефактов Обзор Hugging Face Storage Buckets - S3-совместимого хранилища для чекпоинтов, датасетов и ML-артефактов. Интеграция с Xet, Python и CLI. 5 мин чтения 3773 Гибридные нейро-символические модели: практический гайд по внедрению доменных правил в функцию потерь для обнаружения мошенничества Гайд 2026: как внедрить доменные правила в функцию потерь для обнаружения мошенничества. Практический разбор гибридных нейро-символических моделей на Kaggle Cre 9 мин чтения 3774 Как ИИ реконструирует видео из активности мозга мыши: прорыв в нейробиологии Ученые используют искусственный интеллект для декодирования и реконструкции видео из активности зрительной коры мыши. Подробности нового исследования на 10 март 5 мин чтения 3775 AI-агент атаковал разработчика на GitHub: первые случаи агрессии ИИ и что делать Первый задокументированный случай киберагрессии AI-агента OpenClaw против разработчика. Что это значит для безопасности open source и как защититься. 5 мин чтения 3776 Контекст-инжиниринг для coding-агентов: как структурировать сессии и не сойти с ума Практическое руководство по контекст-инжинирингу для coding-агентов. Учимся структурировать сессии, управлять памятью и избегать типичных ошибок при работе с Cl 12 мин чтения 3777 Thinking Machines Lab и сделка с Nvidia на гигаватты: что известно о новой лаборатории Миры Мурати Мира Мурати запускает Thinking Machines Lab с доступом к гигаваттам вычислений Nvidia. Что это значит для AI-индустрии в 2026 году? 5 мин чтения 3778 YouTube запускает щит для политиков: как пилотный проект против дипфейков изменит правила игры YouTube запускает пилотный проект по защите чиновников и журналистов от AI-фейков. Детекция в реальном времени, ликнесс-сканирование и новая политика платформы. 4 мин чтения 3779 Ryzen AI Max+ 395 - ваш личный суперкомпьютер для LLM. Если, конечно, вы его настроите Полный гайд по установке Fedora, ROCm 8.0 и сборке llama.cpp для бенчмаркинга LLM с контекстом до 250k токенов на Ryzen AI Max+ 395 с 128GB RAM. Команды, ошибки 8 мин чтения 3780 Метод дублирования слоев: как улучшить LLM без изменения весов и занять первое место на Open LLM Leaderboard Узнайте, как метод дублирования слоев улучшает LLM без изменения весов. Практическое руководство для достижения первого места на Open LLM Leaderboard с Qwen2-72 7 мин чтения