Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
2017
Осторожно: скам-модель OpenOSS/privacy-filter на HuggingFace — как распознать малварь
Вредоносная модель на Hugging Face маскируется под privacy-filter. Узнайте, как распознать код base64 и защитить систему от заражения.
2018
Gemma 4 Multi Token Prediction: Google обещает x2, а MLX пока молчит
Google выпустил Gemma 4 с Multi Token Prediction, обещая ускорение в 2-3 раза. Однако MLX до сих пор не поддерживает эту технику. Разбираемся, что пошло не так.
2019
Meera: локальный AI-ассистент для Linux с открытым кодом — инструкция по сборке и настройке
Пошаговая инструкция по установке и настройке Meera — открытого локального AI-ассистента для Linux. Требования к железу, код, конфигурация, типичные ошибки.
2020
Внимание: на Hugging Face обнаружен инфостилер под видом модели privacy-filter — как защититься
Злоумышленники распространяют infostealer через модель Open-OSS/privacy-filter. Подробный разбор схемы заражения (loader.py, PowerShell, EXE) и инструкция по бе
2021
ZAYA1-8B: Острый скальпель вместо кувалды — обзор компактной LLM от Zyphra
Разбираем ZAYA1-8B: почему 8B модель от Zyphra обходит конкурентов, как запустить локально и стоит ли переходить с Llama 3. Тесты, архитектура, советы.
2022
AlphaEvolve: Google DeepMind научил ИИ-агента чинить TPU, Spanner и ускорять Klarna в 2 раза. Без хайпа.
Разбор кейсов AlphaEvolve: снижение write amplification в Spanner на 20%, ускорение обучения трансформера Klarna в 2 раза, оптимизация компилятора TPU. Реальные
2023
Как запустить модель 397B в 14 ГБ ОЗУ: реализация Paged MoE на Mac Studio
Подробный обзор реализации Paged MoE для запуска Qwen3-397B на Mac Studio с 14 ГБ ОЗУ. Сравнение с Flash-MoE и Apple LLM in a Flash, шаги и результаты.
2024
Как создать AI-подкаст и загрузить в Spotify за 10 минут: разбираем новый CLI-инструмент PodAgent
Spotify выпустил PodAgent CLI для генерации подкастов через ИИ. Установка, пример промпта, сравнение с NotebookLM. Создайте свой первый AI-подкаст за 10 минут.
2025
Qwen 3.6 vs Gemma 4: почему одинаковый промпт ломает вывод и как это чинить
Разбираем, как отличаются промпты для Qwen 3.5/3.6 и Gemma 4. Примеры, шаблоны, советы. Адаптируйте запросы под каждую модель, чтобы получить стабильный результ
2026
AMD Instinct MI350P: новый ускоритель CDNA 4 для AI-инференса в форм-факторе PCIe
AMD анонсировала Instinct MI350P на архитектуре CDNA 4. PCIe-ускоритель для инференса с FP4 и улучшенной энергоэффективностью против NVIDIA.
2027
Как настроить и воспитать личного AI-агента на VPS с Hermes Agent: пошаговое руководство
Пошаговое руководство по установке, настройке и обучению Hermes Agent 4.2 на VPS. 4 реальных кейса использования к маю 2026. Автономный AI-агент без облачных AP
2028
Code with Claude 2026: Илон Маск, Opus 4.7 и rate limits, от которых потеют сервера
Anthropic анонсировала Opus 4.7, партнёрство со SpaceX и удвоение лимитов на Code with Claude. Репортаж с конференции для разработчиков.