Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
1921
Meera: локальный AI-ассистент для Linux с открытым кодом — инструкция по сборке и настройке
Пошаговая инструкция по установке и настройке Meera — открытого локального AI-ассистента для Linux. Требования к железу, код, конфигурация, типичные ошибки.
1922
Внимание: на Hugging Face обнаружен инфостилер под видом модели privacy-filter — как защититься
Злоумышленники распространяют infostealer через модель Open-OSS/privacy-filter. Подробный разбор схемы заражения (loader.py, PowerShell, EXE) и инструкция по бе
1923
ZAYA1-8B: Острый скальпель вместо кувалды — обзор компактной LLM от Zyphra
Разбираем ZAYA1-8B: почему 8B модель от Zyphra обходит конкурентов, как запустить локально и стоит ли переходить с Llama 3. Тесты, архитектура, советы.
1924
AlphaEvolve: Google DeepMind научил ИИ-агента чинить TPU, Spanner и ускорять Klarna в 2 раза. Без хайпа.
Разбор кейсов AlphaEvolve: снижение write amplification в Spanner на 20%, ускорение обучения трансформера Klarna в 2 раза, оптимизация компилятора TPU. Реальные
1925
Как запустить модель 397B в 14 ГБ ОЗУ: реализация Paged MoE на Mac Studio
Подробный обзор реализации Paged MoE для запуска Qwen3-397B на Mac Studio с 14 ГБ ОЗУ. Сравнение с Flash-MoE и Apple LLM in a Flash, шаги и результаты.
1926
Как создать AI-подкаст и загрузить в Spotify за 10 минут: разбираем новый CLI-инструмент PodAgent
Spotify выпустил PodAgent CLI для генерации подкастов через ИИ. Установка, пример промпта, сравнение с NotebookLM. Создайте свой первый AI-подкаст за 10 минут.
1927
Qwen 3.6 vs Gemma 4: почему одинаковый промпт ломает вывод и как это чинить
Разбираем, как отличаются промпты для Qwen 3.5/3.6 и Gemma 4. Примеры, шаблоны, советы. Адаптируйте запросы под каждую модель, чтобы получить стабильный результ
1928
AMD Instinct MI350P: новый ускоритель CDNA 4 для AI-инференса в форм-факторе PCIe
AMD анонсировала Instinct MI350P на архитектуре CDNA 4. PCIe-ускоритель для инференса с FP4 и улучшенной энергоэффективностью против NVIDIA.
1929
Как настроить и воспитать личного AI-агента на VPS с Hermes Agent: пошаговое руководство
Пошаговое руководство по установке, настройке и обучению Hermes Agent 4.2 на VPS. 4 реальных кейса использования к маю 2026. Автономный AI-агент без облачных AP
1930
Code with Claude 2026: Илон Маск, Opus 4.7 и rate limits, от которых потеют сервера
Anthropic анонсировала Opus 4.7, партнёрство со SpaceX и удвоение лимитов на Code with Claude. Репортаж с конференции для разработчиков.
1931
Polars vs Pandas: как я переписал workflow и ускорил его в 200 раз
Реальный кейс миграции с Pandas на Polars: почему ленивые вычисления и параллелизм дают 200-кратный прирост скорости. Код, бенчмарки, типичные ошибки.
1932
Почему русский текст в LLM дороже и медленнее: руководство по выбору модели и экономии до 50%
Почему кириллица жрет токены как не в себя? Сравнение GPT-4o, Qwen 3, GigaChat и YandexGPT. Конкретные цифры и советы по экономии до 50% бюджета.