Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
3577
GLM-4.7 на RTX Pro 6000 Blackwell: тесты квантований и альтернативы для ролевых игр
Практический разбор запуска GLM-4.7 358B на RTX Pro 6000 Blackwell с 192GB VRAM. Тесты квантований NVFP4, сравнение с Qwen и выбор модели для ролевых игр на 15.
3578
Разоблачение TB2: как задача db-wal-recovery ломает бенчмарки и как её правильно решить
Глубокий разбор задачи db-wal-recovery из Terminal Bench 2.0. Почему стандартные бенчмарки пасуют перед SQLite WAL и XOR шифрованием. Пошаговое решение.
3579
Homelab для LLM: как окупить сервер на H100 за счёт экспериментов с большими моделями
Реальный кейс: как собрать домашний сервер на H100 для экспериментов с LLM и окупить его, сэкономив на облачных вычислениях. Расчёты, настройка Grafana, выбор ж
3580
Год расплаты: что нужно сделать с архитектурой данных до 2026 года из-за ужесточения EU AI Act, CRA и Data Act
С 15 марта 2026 года ужесточаются требования EU AI Act, CRA и Data Act. Пошаговый план по перестройке архитектуры данных для избежания штрафов.
3581
Провал видео-языковых моделей: как бенчмарк SPLICE выявил неспособность VLMs к временным и причинно-следственным рассуждениям
Новый бенчмарк SPLICE показал, что Gemini 2.0, Qwen2.5-VL и LLaVA-Next проваливают задачи на причинно-следственные связи в видео. Подробности на 15.03.2026.
3582
Тест производительности: ik_llama.cpp против llama.cpp на Qwen3/3.5 MoE - 40% прирост или оптимизация под копирку?
Полный бенчмарк ik_llama.cpp и llama.cpp на Qwen3/3.5 MoE. Команды, настройки, реальный прирост скорости до 40%. Аппаратная конфигурация, квантование Q4_K_M, ан
3583
Практическое руководство по разработке AI-агентов: критика MCP, безопасность и архитектурные принципы
Глубокий разбор ошибок в создании AI-агентов: почему MCP и терминал опасны. Практические принципы безопасности и архитектуры для надежных систем на 15.03.2026.
3584
pH7Console: приватный AI-терминал на Rust, который не шпионит за твоими командами
Обзор pH7Console — приватного AI-терминала на Rust и Tauri 2.0. Работает оффлайн с локальными моделями Phi-3, Qwen2.5, шифрует историю. Установка, сравнение, ко
3585
NVIDIA переписывает правила: лицензия Nemotron 122B стала открытой. И это меняет всё
Разбираем новые лицензионные условия NVIDIA Nemotron 122B. Убраны ограничения на коммерческое использование. Как это повлияет на сообщество локальных LLM?
3586
Qwen3.5-27B против гигантов: разбор результатов Game Agent Coding League и выбор модели для coding agents
Анализ результатов бенчмарка Game Agent Coding League: как Qwen3.5-27B соревнуется с GPT-5.4, Kimi2.5 и GLM-5 в задачах кодирования агентов. Выбор модели для co
3587
Memento: Когда ваш AI-агент наконец запомнит весь репозиторий
Как использовать локальный MCP-сервер Memento для долговременной памяти репозитория в AI-агентах. Возможности, сравнение с аналогами и примеры настройки.
3588
DebugMCP: ИИ-агент находит баги в вашем коде, пока вы пьете кофе
Расширение DebugMCP дает AI-агентам прямой доступ к отладчику VS Code. Точки останова, инспекция переменных и поиск багов на автономе. Анализ на март 2026.