Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
7201
Полное руководство по запуску NSFW-сторителлинга на локальной LLM: от MythoMax до SillyTavern
Пошаговый гайд по запуску интерактивного NSFW-сторителлинга на локальной LLM. Установка MythoMax-l2-13b, SillyTavern, настройка KoboldCCP, оптимизация под AMD R
7202
Как запустить Stable Diffusion и текстовые LLM на ноутбуке с 4 ГБ VRAM: полное руководство
Подробное руководство по запуску Stable Diffusion и текстовых LLM на ноутбуке с 4 ГБ видеопамяти. Оптимизация моделей, сравнение Ollama и LM Studio, работа с кв
7203
TranscriptionSuite: Полный гайд по локальной транскрипции аудио с GUI, дизаризацией и интеграцией с LLM
Обзор TranscriptionSuite - локального приложения для транскрипции на базе faster-whisper с GUI, дизаризацией говорящих и интеграцией с LLM.
7204
GLM-4.7: MoE-монстр, который дешевле GPT и умнее на бенчмарках?
Детальный разбор GLM-4.7 от Zhipu AI: архитектура MoE на 358B параметров, результаты на SWE-bench и Terminal-Bench, сравнение стоимости инференса с Claude 3.5 S
7205
Как запустить KimiLinear-48B с MLA KV Cache в llama.cpp: инструкция по сборке и экономия VRAM с 140GB до 15GB
Пошаговая инструкция по сборке llama.cpp с поддержкой MLA KV Cache для запуска KimiLinear-48B на домашнем железе. Экономия видеопамяти в 10 раз.
7206
Chatterbox Extended и другие локальные инструменты для псевдо-конвертации голоса
Сравнение Chatterbox Extended, RVC и других локальных инструментов для голосового клонирования по короткому аудио. Какое качество за 15 секунд?
7207
Трансформеры vs State-Space модели: какая архитектура устойчивее к атакам? Разбор исследования по adversarial robustness
Новое исследование показывает, что State-Space модели, такие как Mamba, могут быть более устойчивы к adversarial атакам, чем трансформеры. Разбираем результаты
7208
MiniStral vs Gemma vs Qwen: какая модель до 15B справится с агентами, математикой и Raycast?
Практическое сравнение MiniStral 3 14B, Gemma 3 12B и Qwen3-14B для агентных задач, математики и локального Raycast. Тесты, выбор, подводные камни.
7209
Провальный AI-автоответчик: кейс как плохой бот оттолкнул клиента и инструкция по созданию адекватного
История как плохой AI-бот потерял клиента. Практическое руководство по созданию адекватного автоответчика. Дизайн чат-бота, промпты, обратная связь.
7210
Обзор Kreuzberg v4: как Rust-библиотека для обработки документов ускоряет RAG-пайплайны
Обзор Kreuzberg v4 - Rust-библиотеки для извлечения текста, OCR, чанкинга и эмбеддингов. Ускоряет RAG-пайплайны, поддерживает 10 языков и плагины.
7211
Как создать качественный RAG: уроки из Kaggle-соревнования Data-Feeling-School-RAG-Challenge
Разбор реального Kaggle-соревнования по RAG: детерминированность ответов, косинусное сходство эмбеддингов, оценка качества и подводные камни.
7212
Масштабирование LLM: как рассчитать инфраструктуру для 1000 одновременных запросов
Практическое руководство по масштабированию LLM-сервисов: от расчёта GPU и памяти до архитектуры для 1000 RPS. vLLM, TGI, Continuous Batching.