Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
6169
Kinoscriber: как транскрибировать видео локально без интернета и платных подписок
Полный обзор Kinoscriber - веб-приложения для создания субтитров. Тестируем модели Parakeet 2.3, сравниваем скорость и точность, разбираем установку и типичные
6170
Как сделать автоматические субтитры для видео локально в браузере: Parakeet и SileroVAD
Автоматические субтитры для видео в браузере: Parakeet и SileroVAD
6171
R3-Engine: 1.58-битный LLM-движок на Rust, который ломает мозг и AVX-512
Технический разбор R3-Engine: как работает 1.58-битное квантование BitNet b1.58 на Rust с AVX-512, проблема активации SiLU и сравнение с llama.cpp.
6172
Vallignus: как создать супервизор для локальных AI-агентов (CrewAI/AutoGen) и остановить бесконечные циклы
Инструмент Vallignus решает проблему бесконечных циклов локальных AI-агентов. Настройка мониторинга, ограничение времени выполнения, безопасное завершение проце
6173
MiniMax Agent: как за 15 минут создать интерактивное 3D-приложение без кода на примере модели Солнечной системы
Пошаговый гайд по созданию интерактивной 3D-модели Солнечной системы с помощью MiniMax Agent. Без программирования и сложных инструментов.
6174
Семь GPU ревут: считаем, сколько съедает LLM-ферма и как вернуть деньги
Практический гайд по расчету энергозатрат LLM-фермы с 7 GPU. Idle power, пиковая нагрузка до 2500W, оптимизация и реальный ROI.
6175
ClaraVerse vs n8n/Zapier: как создать локальную AI-автоматизацию с 50+ интеграциями
Сравнение ClaraVerse с n8n и Zapier. Создаем локальные AI-воркфлоу с 50+ интеграциями. CLI, API из workflow, приватность данных.
6176
NVMe Swapping: Как запустить ЛЮБУЮ модель Ollama на одном сервере и забыть про OOM ошибки
Техника NVMe Swapping позволяет запускать любые модели Ollama на одном сервере. Экономия VRAM, избавление от OOM ошибок, практическое руководство.
6177
Qwen3-VL-8B генерирует кривой JSON? Вот как настроить сэмплеры и исправить всё
Практический гайд: оптимальные параметры сэмплеров для Qwen3-VL-8B. Исправляем плохой JSON и низкое качество ответов. Настройка температуры, top_p, top_k, penal
6178
Siri на Gemini: Февральский анонс Apple, который перевернёт всё
Всё о грядущем анонсе Apple в феврале 2026: Siri на движке Google Gemini, уход Джона Джаннандреа и как это изменит голосовых ассистентов.
6179
Локальный AI-агент для автотестирования чат-ботов: собираем стенд на GPT-OSS 20B и Agno
Пошаговое руководство по настройке 100% локального AI-агента для автотестирования чат-ботов. GPT-OSS 20B, фреймворк Agno и llama.cpp сервер.
6180
LM Studio OOM на Windows: Почему Full GPU Offload жрёт оперативную память как сумасшедший
Разбираемся, почему LM Studio с Full GPU Offload на Windows ест оперативку даже при 32 ГБ RAM. Полное руководство по GGUF-моделям, распределению памяти и фиксу