Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

2221 Xiaomi MiMo-V2.5: Sparse MoE 310B модель — запуск, квантование и производительность на обычном железе Обзор Xiaomi MiMo-V2.5: разреженная MoE 310B с 15B активных параметров. Как запустить на RTX 4090, квантование, сравнение с DeepSeek и Qwen. Тесты производитель 5 мин чтения 2222 OpenAI на AWS Bedrock: новые модели GPT, Codex и сервис агентов — что это значит для бизнеса Разбираем сделку Amazon и OpenAI на $50 млрд: какие модели GPT и Codex появились на Bedrock, как работает сервис агентов и что это меняет для выбора облачного п 5 мин чтения 2223 Как добавить поддержку MCP в браузерного AI-агента: полное руководство с кодом Пошаговое руководство по интеграции Model Context Protocol в браузерного AI-агента n0x. Код, WebGPU, WASM, реальные примеры, ошибки и советы. 10 мин чтения 2224 Nemotron Nano 3 Omni в llama.cpp: конвертируем мультимодальную модель NVIDIA своими руками Полный гайд по конвертации Nemotron Nano 3 Omni (NVIDIA) в GGUF для llama.cpp. Поддержка текста, изображений, аудио. Инструкция, примеры, сравнение с альтернати 6 мин чтения 2225 Парадокс нуля: почему LLM выгодно ничего не делать Разбираемся, как пропуск нулевых операций в нейросетях снижает энергопотребление и ускоряет большие языковые модели. Pruning, Mixture of Experts и новое железо. 5 мин чтения 2226 Google, OpenAI и xAI заключают сделки с Пентагоном: этические дилеммы и последствия для AI-индустрии Пентагон подписал многомиллиардные контракты с Google, OpenAI и xAI на фоне отказа Anthropic. Разбираем, как военные сделки меняют индустрию AI и её моральные г 7 мин чтения 2227 KV cache бенчмарк Qwen 3.6-35B-A3B на M5 Max: f16, q8_0, turbo3 и turbo4 до 1M контекста Тестируем KV cache квантование для Qwen 3.6-35B-A3B на Mac M5 Max. Сравнение f16, q8_0, TurboQuant 3/4bit. Замеры до 1M токенов. Рекомендации по выбору. 7 мин чтения 2228 GitHub Copilot переходит на оплату по фактическому использованию: что нужно знать разработчикам GitHub Copilot переходит на usage-based billing. Разбираем новые тарифы, AI Credits, как сократить расходы и что это значит для разработчиков. Апрель 2026. 5 мин чтения 2229 Lemonade OmniRouter: Как объединить локальные AI-модели для работы с текстом, изображениями и аудио Lemonade OmniRouter — инструмент для создания единого API из локальных LLM, генераторов изображений и распознавания речи. Как настроить и кому это нужно. 5 мин чтения 2230 Lovable запускает мобильное приложение для vibe coding: как обойти ограничения Apple Lovable выпустил мобильное приложение, которое позволяет создавать приложения через промпты прямо на iPhone. Разбираемся, как разработчики обошли строгие правил 4 мин чтения 2231 Poolside Laguna XS.2: возможности 33B MoE модели с открытой лицензией Обзор Poolside Laguna XS.2 — открытой 33B MoE модели, сравнимой с Qwen 3.5. Агентские бенчмарки, примеры использования, сравнение с аналогами. 4 мин чтения 2232 Голосом по складу: как робот-паллетовоз научился понимать команды (и ошибаться) Первый тест голосового управления складским роботом: точность 94%, задержка 200 мс, но шум и акценты ставят палки в колеса. Подробности и границы технологии. 4 мин чтения