Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

1921 Meera: локальный AI-ассистент для Linux с открытым кодом — инструкция по сборке и настройке Пошаговая инструкция по установке и настройке Meera — открытого локального AI-ассистента для Linux. Требования к железу, код, конфигурация, типичные ошибки. 8 мин чтения 1922 Внимание: на Hugging Face обнаружен инфостилер под видом модели privacy-filter — как защититься Злоумышленники распространяют infostealer через модель Open-OSS/privacy-filter. Подробный разбор схемы заражения (loader.py, PowerShell, EXE) и инструкция по бе 3 мин чтения 1923 ZAYA1-8B: Острый скальпель вместо кувалды — обзор компактной LLM от Zyphra Разбираем ZAYA1-8B: почему 8B модель от Zyphra обходит конкурентов, как запустить локально и стоит ли переходить с Llama 3. Тесты, архитектура, советы. 5 мин чтения 1924 AlphaEvolve: Google DeepMind научил ИИ-агента чинить TPU, Spanner и ускорять Klarna в 2 раза. Без хайпа. Разбор кейсов AlphaEvolve: снижение write amplification в Spanner на 20%, ускорение обучения трансформера Klarna в 2 раза, оптимизация компилятора TPU. Реальные 4 мин чтения 1925 Как запустить модель 397B в 14 ГБ ОЗУ: реализация Paged MoE на Mac Studio Подробный обзор реализации Paged MoE для запуска Qwen3-397B на Mac Studio с 14 ГБ ОЗУ. Сравнение с Flash-MoE и Apple LLM in a Flash, шаги и результаты. 5 мин чтения 1926 Как создать AI-подкаст и загрузить в Spotify за 10 минут: разбираем новый CLI-инструмент PodAgent Spotify выпустил PodAgent CLI для генерации подкастов через ИИ. Установка, пример промпта, сравнение с NotebookLM. Создайте свой первый AI-подкаст за 10 минут. 5 мин чтения 1927 Qwen 3.6 vs Gemma 4: почему одинаковый промпт ломает вывод и как это чинить Разбираем, как отличаются промпты для Qwen 3.5/3.6 и Gemma 4. Примеры, шаблоны, советы. Адаптируйте запросы под каждую модель, чтобы получить стабильный результ 6 мин чтения 1928 AMD Instinct MI350P: новый ускоритель CDNA 4 для AI-инференса в форм-факторе PCIe AMD анонсировала Instinct MI350P на архитектуре CDNA 4. PCIe-ускоритель для инференса с FP4 и улучшенной энергоэффективностью против NVIDIA. 4 мин чтения 1929 Как настроить и воспитать личного AI-агента на VPS с Hermes Agent: пошаговое руководство Пошаговое руководство по установке, настройке и обучению Hermes Agent 4.2 на VPS. 4 реальных кейса использования к маю 2026. Автономный AI-агент без облачных AP 10 мин чтения 1930 Code with Claude 2026: Илон Маск, Opus 4.7 и rate limits, от которых потеют сервера Anthropic анонсировала Opus 4.7, партнёрство со SpaceX и удвоение лимитов на Code with Claude. Репортаж с конференции для разработчиков. 4 мин чтения 1931 Polars vs Pandas: как я переписал workflow и ускорил его в 200 раз Реальный кейс миграции с Pandas на Polars: почему ленивые вычисления и параллелизм дают 200-кратный прирост скорости. Код, бенчмарки, типичные ошибки. 7 мин чтения 1932 Почему русский текст в LLM дороже и медленнее: руководство по выбору модели и экономии до 50% Почему кириллица жрет токены как не в себя? Сравнение GPT-4o, Qwen 3, GigaChat и YandexGPT. Конкретные цифры и советы по экономии до 50% бюджета. 8 мин чтения