Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

2017 Осторожно: скам-модель OpenOSS/privacy-filter на HuggingFace — как распознать малварь Вредоносная модель на Hugging Face маскируется под privacy-filter. Узнайте, как распознать код base64 и защитить систему от заражения. 4 мин чтения 2018 Gemma 4 Multi Token Prediction: Google обещает x2, а MLX пока молчит Google выпустил Gemma 4 с Multi Token Prediction, обещая ускорение в 2-3 раза. Однако MLX до сих пор не поддерживает эту технику. Разбираемся, что пошло не так. 5 мин чтения 2019 Meera: локальный AI-ассистент для Linux с открытым кодом — инструкция по сборке и настройке Пошаговая инструкция по установке и настройке Meera — открытого локального AI-ассистента для Linux. Требования к железу, код, конфигурация, типичные ошибки. 8 мин чтения 2020 Внимание: на Hugging Face обнаружен инфостилер под видом модели privacy-filter — как защититься Злоумышленники распространяют infostealer через модель Open-OSS/privacy-filter. Подробный разбор схемы заражения (loader.py, PowerShell, EXE) и инструкция по бе 3 мин чтения 2021 ZAYA1-8B: Острый скальпель вместо кувалды — обзор компактной LLM от Zyphra Разбираем ZAYA1-8B: почему 8B модель от Zyphra обходит конкурентов, как запустить локально и стоит ли переходить с Llama 3. Тесты, архитектура, советы. 5 мин чтения 2022 AlphaEvolve: Google DeepMind научил ИИ-агента чинить TPU, Spanner и ускорять Klarna в 2 раза. Без хайпа. Разбор кейсов AlphaEvolve: снижение write amplification в Spanner на 20%, ускорение обучения трансформера Klarna в 2 раза, оптимизация компилятора TPU. Реальные 4 мин чтения 2023 Как запустить модель 397B в 14 ГБ ОЗУ: реализация Paged MoE на Mac Studio Подробный обзор реализации Paged MoE для запуска Qwen3-397B на Mac Studio с 14 ГБ ОЗУ. Сравнение с Flash-MoE и Apple LLM in a Flash, шаги и результаты. 5 мин чтения 2024 Как создать AI-подкаст и загрузить в Spotify за 10 минут: разбираем новый CLI-инструмент PodAgent Spotify выпустил PodAgent CLI для генерации подкастов через ИИ. Установка, пример промпта, сравнение с NotebookLM. Создайте свой первый AI-подкаст за 10 минут. 5 мин чтения 2025 Qwen 3.6 vs Gemma 4: почему одинаковый промпт ломает вывод и как это чинить Разбираем, как отличаются промпты для Qwen 3.5/3.6 и Gemma 4. Примеры, шаблоны, советы. Адаптируйте запросы под каждую модель, чтобы получить стабильный результ 6 мин чтения 2026 AMD Instinct MI350P: новый ускоритель CDNA 4 для AI-инференса в форм-факторе PCIe AMD анонсировала Instinct MI350P на архитектуре CDNA 4. PCIe-ускоритель для инференса с FP4 и улучшенной энергоэффективностью против NVIDIA. 4 мин чтения 2027 Как настроить и воспитать личного AI-агента на VPS с Hermes Agent: пошаговое руководство Пошаговое руководство по установке, настройке и обучению Hermes Agent 4.2 на VPS. 4 реальных кейса использования к маю 2026. Автономный AI-агент без облачных AP 10 мин чтения 2028 Code with Claude 2026: Илон Маск, Opus 4.7 и rate limits, от которых потеют сервера Anthropic анонсировала Opus 4.7, партнёрство со SpaceX и удвоение лимитов на Code with Claude. Репортаж с конференции для разработчиков. 4 мин чтения