Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
3061
Франкенштейн-сборка: 120 ГБ VRAM на мини-ПК — пошаговый гайд по подключению 4 GPU (3x P40 + RTX 8000)
Полный гайд по созданию монстра для локальных LLM: подключаем 3 Tesla P40 и RTX 8000 к мини-ПК через OCuLink и USB4. 120 ГБ VRAM для моделей 2026 года.
3062
Как объединить 31 бесплатную модель NVIDIA NIM в один прокси с авто-маршрутизацией и обходом лимитов
Готовое решение для объединения 31 бесплатной модели NVIDIA NIM в один прокси с автоматическим роутингом, failover и обходом лимитов запросов. Установка и конфи
3063
Почему Nemotron 3 Super показывает разное качество в llama.cpp и vLLM: техническое расследование
Техническое расследование различий в качестве Nemotron 3 Super в llama.cpp (55.4%) и vLLM (40.2%). Причины, бенчмарки, рекомендации на 28.03.2026.
3064
Парадокс Джевонса в AI: как оптимизация моделей ведет к дефициту железа
Почему улучшение AI-моделей увеличивает спрос на RAM и GPU? Объяснение парадокса Джевонса в искусственном интеллекте. Актуальные данные на март 2026.
3065
Turboquant на Apple M5 Max: когда скорость prefill убивает всю магию
Разбор новой техники квантования Turboquant на Mac M5 Max. Экспоненциальный рост времени prefill, сравнение с MLX и GGUF, и кому это все нужно в 2026 году.
3066
SLM для NPC: зачем гнаться за 2B параметрами, если Qwen 1.5B умеет в JSON
Практический гайд по использованию маленьких языковых моделей (SLM) для NPC. Выбор модели, JSON vs естественный язык, промпт-инжиниринг на Qwen 1.5B Instruct.
3067
Как создать skill для Claude Code: управление мобильной связью через терминал
Пошаговый гайд по созданию навыка для Claude Code 3.0. Автоматизируйте управление услугами оператора через терминал с Puppeteer. Актуально на 2026 год.
3068
Рекурсивное самосовершенствование ИИ: когда алгоритм начинает править собой
Технический разбор рекурсивного самосовершенствования ИИ (RSI). Как ИИ меняет свой код, почему это рубеж к AGI и что не так с эндогенной оптимизацией.
3069
ИИ-агенты взломали корпоративные сети: первый громкий инцидент и уроки безопасности
Первый крупный взлом корпоративных сетей автономными ИИ-агентами произошел в марте 2026. Детали атаки, причины и как защитить инфраструктуру.
3070
Как реализовать контроль доступа и управление доверием в swarm из AI-агентов
Гид по безопасности многоагентных систем. Шаги по внедрению децентрализованных идентификаторов, контроля доступа и управления доверием для swarm из AI-агентов.
3071
Llama.cpp с TurboQuant, H2O и StreamingLLM: полное руководство по настройке для контекста 256k+
Пошаговый гайд по интеграции TurboQuant, Heavy-Hitter Oracle и StreamingLLM в llama.cpp для работы с контекстом 256k+ на ограниченном VRAM.
3072
Сломанные скрипты после обновления llama-server: как отключить миграцию кэша HuggingFace
Критическое изменение в llama-server версии 2.2 переносит кэш моделей. Гайд по отключению миграции и восстановлению workflow на 28.03.2026.