Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
2221
Xiaomi MiMo-V2.5: Sparse MoE 310B модель — запуск, квантование и производительность на обычном железе
Обзор Xiaomi MiMo-V2.5: разреженная MoE 310B с 15B активных параметров. Как запустить на RTX 4090, квантование, сравнение с DeepSeek и Qwen. Тесты производитель
2222
OpenAI на AWS Bedrock: новые модели GPT, Codex и сервис агентов — что это значит для бизнеса
Разбираем сделку Amazon и OpenAI на $50 млрд: какие модели GPT и Codex появились на Bedrock, как работает сервис агентов и что это меняет для выбора облачного п
2223
Как добавить поддержку MCP в браузерного AI-агента: полное руководство с кодом
Пошаговое руководство по интеграции Model Context Protocol в браузерного AI-агента n0x. Код, WebGPU, WASM, реальные примеры, ошибки и советы.
2224
Nemotron Nano 3 Omni в llama.cpp: конвертируем мультимодальную модель NVIDIA своими руками
Полный гайд по конвертации Nemotron Nano 3 Omni (NVIDIA) в GGUF для llama.cpp. Поддержка текста, изображений, аудио. Инструкция, примеры, сравнение с альтернати
2225
Парадокс нуля: почему LLM выгодно ничего не делать
Разбираемся, как пропуск нулевых операций в нейросетях снижает энергопотребление и ускоряет большие языковые модели. Pruning, Mixture of Experts и новое железо.
2226
Google, OpenAI и xAI заключают сделки с Пентагоном: этические дилеммы и последствия для AI-индустрии
Пентагон подписал многомиллиардные контракты с Google, OpenAI и xAI на фоне отказа Anthropic. Разбираем, как военные сделки меняют индустрию AI и её моральные г
2227
KV cache бенчмарк Qwen 3.6-35B-A3B на M5 Max: f16, q8_0, turbo3 и turbo4 до 1M контекста
Тестируем KV cache квантование для Qwen 3.6-35B-A3B на Mac M5 Max. Сравнение f16, q8_0, TurboQuant 3/4bit. Замеры до 1M токенов. Рекомендации по выбору.
2228
GitHub Copilot переходит на оплату по фактическому использованию: что нужно знать разработчикам
GitHub Copilot переходит на usage-based billing. Разбираем новые тарифы, AI Credits, как сократить расходы и что это значит для разработчиков. Апрель 2026.
2229
Lemonade OmniRouter: Как объединить локальные AI-модели для работы с текстом, изображениями и аудио
Lemonade OmniRouter — инструмент для создания единого API из локальных LLM, генераторов изображений и распознавания речи. Как настроить и кому это нужно.
2230
Lovable запускает мобильное приложение для vibe coding: как обойти ограничения Apple
Lovable выпустил мобильное приложение, которое позволяет создавать приложения через промпты прямо на iPhone. Разбираемся, как разработчики обошли строгие правил
2231
Poolside Laguna XS.2: возможности 33B MoE модели с открытой лицензией
Обзор Poolside Laguna XS.2 — открытой 33B MoE модели, сравнимой с Qwen 3.5. Агентские бенчмарки, примеры использования, сравнение с аналогами.
2232
Голосом по складу: как робот-паллетовоз научился понимать команды (и ошибаться)
Первый тест голосового управления складским роботом: точность 94%, задержка 200 мс, но шум и акценты ставят палки в колеса. Подробности и границы технологии.