Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

3061 Франкенштейн-сборка: 120 ГБ VRAM на мини-ПК — пошаговый гайд по подключению 4 GPU (3x P40 + RTX 8000) Полный гайд по созданию монстра для локальных LLM: подключаем 3 Tesla P40 и RTX 8000 к мини-ПК через OCuLink и USB4. 120 ГБ VRAM для моделей 2026 года. 9 мин чтения 3062 Как объединить 31 бесплатную модель NVIDIA NIM в один прокси с авто-маршрутизацией и обходом лимитов Готовое решение для объединения 31 бесплатной модели NVIDIA NIM в один прокси с автоматическим роутингом, failover и обходом лимитов запросов. Установка и конфи 6 мин чтения 3063 Почему Nemotron 3 Super показывает разное качество в llama.cpp и vLLM: техническое расследование Техническое расследование различий в качестве Nemotron 3 Super в llama.cpp (55.4%) и vLLM (40.2%). Причины, бенчмарки, рекомендации на 28.03.2026. 5 мин чтения 3064 Парадокс Джевонса в AI: как оптимизация моделей ведет к дефициту железа Почему улучшение AI-моделей увеличивает спрос на RAM и GPU? Объяснение парадокса Джевонса в искусственном интеллекте. Актуальные данные на март 2026. 4 мин чтения 3065 Turboquant на Apple M5 Max: когда скорость prefill убивает всю магию Разбор новой техники квантования Turboquant на Mac M5 Max. Экспоненциальный рост времени prefill, сравнение с MLX и GGUF, и кому это все нужно в 2026 году. 5 мин чтения 3066 SLM для NPC: зачем гнаться за 2B параметрами, если Qwen 1.5B умеет в JSON Практический гайд по использованию маленьких языковых моделей (SLM) для NPC. Выбор модели, JSON vs естественный язык, промпт-инжиниринг на Qwen 1.5B Instruct. 10 мин чтения 3067 Как создать skill для Claude Code: управление мобильной связью через терминал Пошаговый гайд по созданию навыка для Claude Code 3.0. Автоматизируйте управление услугами оператора через терминал с Puppeteer. Актуально на 2026 год. 8 мин чтения 3068 Рекурсивное самосовершенствование ИИ: когда алгоритм начинает править собой Технический разбор рекурсивного самосовершенствования ИИ (RSI). Как ИИ меняет свой код, почему это рубеж к AGI и что не так с эндогенной оптимизацией. 7 мин чтения 3069 ИИ-агенты взломали корпоративные сети: первый громкий инцидент и уроки безопасности Первый крупный взлом корпоративных сетей автономными ИИ-агентами произошел в марте 2026. Детали атаки, причины и как защитить инфраструктуру. 4 мин чтения 3070 Как реализовать контроль доступа и управление доверием в swarm из AI-агентов Гид по безопасности многоагентных систем. Шаги по внедрению децентрализованных идентификаторов, контроля доступа и управления доверием для swarm из AI-агентов. 9 мин чтения 3071 Llama.cpp с TurboQuant, H2O и StreamingLLM: полное руководство по настройке для контекста 256k+ Пошаговый гайд по интеграции TurboQuant, Heavy-Hitter Oracle и StreamingLLM в llama.cpp для работы с контекстом 256k+ на ограниченном VRAM. 7 мин чтения 3072 Сломанные скрипты после обновления llama-server: как отключить миграцию кэша HuggingFace Критическое изменение в llama-server версии 2.2 переносит кэш моделей. Гайд по отключению миграции и восстановлению workflow на 28.03.2026. 4 мин чтения