Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
3481
Amazon vs NVIDIA: как разделённое ИИ-железо меняет инференс и что ждать от рынка
Как Amazon обходит NVIDIA в инференсе ИИ с помощью специализированных чипов. Анализ рынка и прогнозы на 2026 год.
3482
Локальный движок роевого интеллекта для macOS: установка и использование multi-agent дебатов на Apple Silicon
Запускайте multi-agent дебаты AI локально на macOS с Apple Silicon. Конфиденциальность, глубокий анализ, установка и примеры использования.
3483
FlashMotion: как использовать контролируемую генерацию видео с 50-кратным ускорением локально
Руководство по FlashMotion - революционной модели для контролируемой генерации видео с 50-кратным ускорением. Установка, примеры, сравнение с Kling и SVD.
3484
MJ1: 3B мультимодальный судья, превосходящий Gemini-3-Pro — анализ прорыва и ограничений
Модель MJ1 с 3B параметров обходит Gemini-3-Pro в оценке мультимодального контента. Разбор сенсационных результатов и ключевых ограничений на 18.03.2026.
3485
Как отказаться от сложного ретривел-пайплайна: используем встроенные знания LLM о Git и терминале
Разоблачаем избыточный код: как использовать встроенные знания LLM о Git и терминале без сложных ретривел-пайплайнов. Практический гайд для DevOps.
3486
Лучшая сборка для локального ИИ на слабом железе: OmniCoder-9B, llama.cpp и 32 ГБ ОЗУ
Полное руководство по запуску OmniCoder-9B с llama.cpp на слабом железе. Квантование Q4_K_M, настройка CUDA, тесты скорости. Ежедневный кодинг без облачных затр
3487
Баг Nemotron 3 Super: почему модель зацикливается на своём reasoning и как это исправить
Технический разбор бага Nemotron 3 Super: модель создает бесконечный цикл, интерпретируя свои reasoning-шаги как пользовательский ввод. Причины, фикс через llam
3488
Как собрать бюджетный 6-GPU мультиплексор на K80: 72 GB VRAM за $200 для мгновенного переключения моделей
Пошаговый гайд по сборке бюджетного 6-GPU мультиплексора на NVIDIA K80 с 72 GB VRAM за $200. Кастомный kernel модуль, pure C инференс, переключение моделей за 0
3489
Stealth-модели MiMo V2 на Openrouter: детали Hunter/Healer Alpha и что ждать дальше
Раскрываем детали stealth-моделей MiMo V2 Hunter Alpha и Healer Alpha на Openrouter. Контекстное окно 1M токенов, текстовое рассуждение и что ждать в будущем.
3490
Как удвоить скорость Multi-GPU в llama.cpp: диагностика асимметричных PCI-E lanes и настройка CUDA_VISIBLE_DEVICES
Узнайте, как диагностировать асимметричные PCI-E lanes и настроить CUDA_VISIBLE_DEVICES для удвоения скорости multi-GPU в llama.cpp. Готовые команды и пошаговое
3491
GLM 5 против Claude Code: неожиданный лидер в тестах на реальных задачах веб-разработки
Новый тест на создание real-time приложений показал, что open-source модель GLM 5 превосходит Claude Code в сложных задачах веб-разработки. Детали и результаты.
3492
Hugging Face Agents: Локальная LLM одной командой. И больше никакой возни с квантованием.
Обзор hf-agents: как запустить оптимизированную локальную LLM одной командой с автоопределением железа и квантованием. Примеры, сравнения, кому подойдет.