Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

6169 Kinoscriber: как транскрибировать видео локально без интернета и платных подписок Полный обзор Kinoscriber - веб-приложения для создания субтитров. Тестируем модели Parakeet 2.3, сравниваем скорость и точность, разбираем установку и типичные 7 мин чтения 6170 Как сделать автоматические субтитры для видео локально в браузере: Parakeet и SileroVAD Автоматические субтитры для видео в браузере: Parakeet и SileroVAD 1 мин чтения 6171 R3-Engine: 1.58-битный LLM-движок на Rust, который ломает мозг и AVX-512 Технический разбор R3-Engine: как работает 1.58-битное квантование BitNet b1.58 на Rust с AVX-512, проблема активации SiLU и сравнение с llama.cpp. 4 мин чтения 6172 Vallignus: как создать супервизор для локальных AI-агентов (CrewAI/AutoGen) и остановить бесконечные циклы Инструмент Vallignus решает проблему бесконечных циклов локальных AI-агентов. Настройка мониторинга, ограничение времени выполнения, безопасное завершение проце 7 мин чтения 6173 MiniMax Agent: как за 15 минут создать интерактивное 3D-приложение без кода на примере модели Солнечной системы Пошаговый гайд по созданию интерактивной 3D-модели Солнечной системы с помощью MiniMax Agent. Без программирования и сложных инструментов. 10 мин чтения 6174 Семь GPU ревут: считаем, сколько съедает LLM-ферма и как вернуть деньги Практический гайд по расчету энергозатрат LLM-фермы с 7 GPU. Idle power, пиковая нагрузка до 2500W, оптимизация и реальный ROI. 9 мин чтения 6175 ClaraVerse vs n8n/Zapier: как создать локальную AI-автоматизацию с 50+ интеграциями Сравнение ClaraVerse с n8n и Zapier. Создаем локальные AI-воркфлоу с 50+ интеграциями. CLI, API из workflow, приватность данных. 7 мин чтения 6176 NVMe Swapping: Как запустить ЛЮБУЮ модель Ollama на одном сервере и забыть про OOM ошибки Техника NVMe Swapping позволяет запускать любые модели Ollama на одном сервере. Экономия VRAM, избавление от OOM ошибок, практическое руководство. 8 мин чтения 6177 Qwen3-VL-8B генерирует кривой JSON? Вот как настроить сэмплеры и исправить всё Практический гайд: оптимальные параметры сэмплеров для Qwen3-VL-8B. Исправляем плохой JSON и низкое качество ответов. Настройка температуры, top_p, top_k, penal 8 мин чтения 6178 Siri на Gemini: Февральский анонс Apple, который перевернёт всё Всё о грядущем анонсе Apple в феврале 2026: Siri на движке Google Gemini, уход Джона Джаннандреа и как это изменит голосовых ассистентов. 5 мин чтения 6179 Локальный AI-агент для автотестирования чат-ботов: собираем стенд на GPT-OSS 20B и Agno Пошаговое руководство по настройке 100% локального AI-агента для автотестирования чат-ботов. GPT-OSS 20B, фреймворк Agno и llama.cpp сервер. 8 мин чтения 6180 LM Studio OOM на Windows: Почему Full GPU Offload жрёт оперативную память как сумасшедший Разбираемся, почему LM Studio с Full GPU Offload на Windows ест оперативку даже при 32 ГБ RAM. Полное руководство по GGUF-моделям, распределению памяти и фиксу 8 мин чтения