Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
2773
Как запустить Gemma 4 31B с контекстом 256K на одной RTX 5090: практическое руководство по TurboQuant KV Cache сжатию
Пошаговое руководство по сжатию KV-кэша TurboQuant для запуска Gemma 4 31B с контекстом 256K на одной видеокарте RTX 5090. Оптимизация памяти, настройки, ошибки
2774
Gemma 4 как мультиагентный координатор: практическое руководство по настройке и тестированию
Пошаговое руководство по настройке Gemma 4 E2B как координатора мультиагентных систем. Tool calling, декомпозиция задач, тестирование на реальных кейсах.
2775
VOID от Netflix: как вырезать из видео все, что мешает
Обзор VOID от Netflix на Hugging Face. Как работает модель для удаления объектов из видео, сравнение с аналогами и кому она нужна в 2026 году.
2776
Memory Agent от Google: как заменить векторные базы данных на SQLite и LLM-рассуждение для Obsidian
Пошаговый гайд по замене векторных БД на SQLite и LLM-рассуждение для Obsidian с использованием Memory Agent от Google. Актуально на 2026 год.
2777
Зависимость от агентного кодирования: как Claude Code и промпты крадут сон у разработчиков
Разработчики теряют сон из-за компульсивного использования Claude Code. Новые данные на 03.04.2026 о психологической зависимости от AI-агентов.
2778
ClawRouter: настройка open-source LLM-роутера для экономии до 85% на API-запросах
Настройка ClawRouter для умного роутинга запросов к LLM. Сравнение с RouteLLM и Unify. Примеры использования и экономия токенов.
2779
Trinity-Large-Thinking 400B: обзор и настройка открытой reasoning-модели, которая в 28 раз дешевле Claude Opus
Открытая reasoning-модель Trinity-Large-Thinking 400B от Arcee AI: 400B параметров, в 28 раз дешевле Claude Opus. Обзор, настройка, сравнение.
2780
PromptPilot: настройка очереди задач и Telegram-бота для AI CLI (Claude Code, Codex)
Как настроить PromptPilot для управления промптами, обхода rate limit и экономии токенов в Claude Code и Codex. Актуально на 2026 год.
2781
ИИ-агенты в 2026: почему бизнес боится внедрять автономных помощников и в чём их реальная польза
Анализ автономных ИИ-агентов в 2026 году. Почему компании боятся внедрять их, несмотря на огромный потенциал для автоматизации бизнес-процессов.
2782
Антипаттерны AI-кода: разбор сайта CEO YC и как избежать 6 МБ мусора на главной странице
Разбор реального случая с сайтом CEO YC: 6 МБ мусора, 8 логотипов и тестовые файлы на продакшене. Как избежать таких ошибок при генерации кода ИИ.
2783
Запуск Gemma-4 26B на M5 MacBook Air: рекордная производительность и энергоэффективность с квантованием IQ4_XS
Как запустить Gemma-4 26B на MacBook Air M5 с IQ4_XS: 12 t/s генерации, 8W. Полное руководство по настройке llama.cpp и оптимизации.
2784
Странное поведение Gemma 4 26b при генерации кода: тест-кейс с игрой Breakout и что это значит
Тестируем новую Gemma 4 26b на генерации кода для игры Breakout. Результаты удивляют странными логическими ошибками и показывают, что не все так гладко с послед