Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

3481 Amazon vs NVIDIA: как разделённое ИИ-железо меняет инференс и что ждать от рынка Как Amazon обходит NVIDIA в инференсе ИИ с помощью специализированных чипов. Анализ рынка и прогнозы на 2026 год. 3 мин чтения 3482 Локальный движок роевого интеллекта для macOS: установка и использование multi-agent дебатов на Apple Silicon Запускайте multi-agent дебаты AI локально на macOS с Apple Silicon. Конфиденциальность, глубокий анализ, установка и примеры использования. 5 мин чтения 3483 FlashMotion: как использовать контролируемую генерацию видео с 50-кратным ускорением локально Руководство по FlashMotion - революционной модели для контролируемой генерации видео с 50-кратным ускорением. Установка, примеры, сравнение с Kling и SVD. 6 мин чтения 3484 MJ1: 3B мультимодальный судья, превосходящий Gemini-3-Pro — анализ прорыва и ограничений Модель MJ1 с 3B параметров обходит Gemini-3-Pro в оценке мультимодального контента. Разбор сенсационных результатов и ключевых ограничений на 18.03.2026. 5 мин чтения 3485 Как отказаться от сложного ретривел-пайплайна: используем встроенные знания LLM о Git и терминале Разоблачаем избыточный код: как использовать встроенные знания LLM о Git и терминале без сложных ретривел-пайплайнов. Практический гайд для DevOps. 8 мин чтения 3486 Лучшая сборка для локального ИИ на слабом железе: OmniCoder-9B, llama.cpp и 32 ГБ ОЗУ Полное руководство по запуску OmniCoder-9B с llama.cpp на слабом железе. Квантование Q4_K_M, настройка CUDA, тесты скорости. Ежедневный кодинг без облачных затр 9 мин чтения 3487 Баг Nemotron 3 Super: почему модель зацикливается на своём reasoning и как это исправить Технический разбор бага Nemotron 3 Super: модель создает бесконечный цикл, интерпретируя свои reasoning-шаги как пользовательский ввод. Причины, фикс через llam 5 мин чтения 3488 Как собрать бюджетный 6-GPU мультиплексор на K80: 72 GB VRAM за $200 для мгновенного переключения моделей Пошаговый гайд по сборке бюджетного 6-GPU мультиплексора на NVIDIA K80 с 72 GB VRAM за $200. Кастомный kernel модуль, pure C инференс, переключение моделей за 0 7 мин чтения 3489 Stealth-модели MiMo V2 на Openrouter: детали Hunter/Healer Alpha и что ждать дальше Раскрываем детали stealth-моделей MiMo V2 Hunter Alpha и Healer Alpha на Openrouter. Контекстное окно 1M токенов, текстовое рассуждение и что ждать в будущем. 4 мин чтения 3490 Как удвоить скорость Multi-GPU в llama.cpp: диагностика асимметричных PCI-E lanes и настройка CUDA_VISIBLE_DEVICES Узнайте, как диагностировать асимметричные PCI-E lanes и настроить CUDA_VISIBLE_DEVICES для удвоения скорости multi-GPU в llama.cpp. Готовые команды и пошаговое 7 мин чтения 3491 GLM 5 против Claude Code: неожиданный лидер в тестах на реальных задачах веб-разработки Новый тест на создание real-time приложений показал, что open-source модель GLM 5 превосходит Claude Code в сложных задачах веб-разработки. Детали и результаты. 4 мин чтения 3492 Hugging Face Agents: Локальная LLM одной командой. И больше никакой возни с квантованием. Обзор hf-agents: как запустить оптимизированную локальную LLM одной командой с автоопределением железа и квантованием. Примеры, сравнения, кому подойдет. 5 мин чтения