Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

2773 Как запустить Gemma 4 31B с контекстом 256K на одной RTX 5090: практическое руководство по TurboQuant KV Cache сжатию Пошаговое руководство по сжатию KV-кэша TurboQuant для запуска Gemma 4 31B с контекстом 256K на одной видеокарте RTX 5090. Оптимизация памяти, настройки, ошибки 8 мин чтения 2774 Gemma 4 как мультиагентный координатор: практическое руководство по настройке и тестированию Пошаговое руководство по настройке Gemma 4 E2B как координатора мультиагентных систем. Tool calling, декомпозиция задач, тестирование на реальных кейсах. 8 мин чтения 2775 VOID от Netflix: как вырезать из видео все, что мешает Обзор VOID от Netflix на Hugging Face. Как работает модель для удаления объектов из видео, сравнение с аналогами и кому она нужна в 2026 году. 6 мин чтения 2776 Memory Agent от Google: как заменить векторные базы данных на SQLite и LLM-рассуждение для Obsidian Пошаговый гайд по замене векторных БД на SQLite и LLM-рассуждение для Obsidian с использованием Memory Agent от Google. Актуально на 2026 год. 8 мин чтения 2777 Зависимость от агентного кодирования: как Claude Code и промпты крадут сон у разработчиков Разработчики теряют сон из-за компульсивного использования Claude Code. Новые данные на 03.04.2026 о психологической зависимости от AI-агентов. 5 мин чтения 2778 ClawRouter: настройка open-source LLM-роутера для экономии до 85% на API-запросах Настройка ClawRouter для умного роутинга запросов к LLM. Сравнение с RouteLLM и Unify. Примеры использования и экономия токенов. 4 мин чтения 2779 Trinity-Large-Thinking 400B: обзор и настройка открытой reasoning-модели, которая в 28 раз дешевле Claude Opus Открытая reasoning-модель Trinity-Large-Thinking 400B от Arcee AI: 400B параметров, в 28 раз дешевле Claude Opus. Обзор, настройка, сравнение. 4 мин чтения 2780 PromptPilot: настройка очереди задач и Telegram-бота для AI CLI (Claude Code, Codex) Как настроить PromptPilot для управления промптами, обхода rate limit и экономии токенов в Claude Code и Codex. Актуально на 2026 год. 4 мин чтения 2781 ИИ-агенты в 2026: почему бизнес боится внедрять автономных помощников и в чём их реальная польза Анализ автономных ИИ-агентов в 2026 году. Почему компании боятся внедрять их, несмотря на огромный потенциал для автоматизации бизнес-процессов. 5 мин чтения 2782 Антипаттерны AI-кода: разбор сайта CEO YC и как избежать 6 МБ мусора на главной странице Разбор реального случая с сайтом CEO YC: 6 МБ мусора, 8 логотипов и тестовые файлы на продакшене. Как избежать таких ошибок при генерации кода ИИ. 6 мин чтения 2783 Запуск Gemma-4 26B на M5 MacBook Air: рекордная производительность и энергоэффективность с квантованием IQ4_XS Как запустить Gemma-4 26B на MacBook Air M5 с IQ4_XS: 12 t/s генерации, 8W. Полное руководство по настройке llama.cpp и оптимизации. 6 мин чтения 2784 Странное поведение Gemma 4 26b при генерации кода: тест-кейс с игрой Breakout и что это значит Тестируем новую Gemma 4 26b на генерации кода для игры Breakout. Результаты удивляют странными логическими ошибками и показывают, что не все так гладко с послед 5 мин чтения