Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

7201 Полное руководство по запуску NSFW-сторителлинга на локальной LLM: от MythoMax до SillyTavern Пошаговый гайд по запуску интерактивного NSFW-сторителлинга на локальной LLM. Установка MythoMax-l2-13b, SillyTavern, настройка KoboldCCP, оптимизация под AMD R 9 мин чтения 7202 Как запустить Stable Diffusion и текстовые LLM на ноутбуке с 4 ГБ VRAM: полное руководство Подробное руководство по запуску Stable Diffusion и текстовых LLM на ноутбуке с 4 ГБ видеопамяти. Оптимизация моделей, сравнение Ollama и LM Studio, работа с кв 5 мин чтения 7203 TranscriptionSuite: Полный гайд по локальной транскрипции аудио с GUI, дизаризацией и интеграцией с LLM Обзор TranscriptionSuite - локального приложения для транскрипции на базе faster-whisper с GUI, дизаризацией говорящих и интеграцией с LLM. 6 мин чтения 7204 GLM-4.7: MoE-монстр, который дешевле GPT и умнее на бенчмарках? Детальный разбор GLM-4.7 от Zhipu AI: архитектура MoE на 358B параметров, результаты на SWE-bench и Terminal-Bench, сравнение стоимости инференса с Claude 3.5 S 5 мин чтения 7205 Как запустить KimiLinear-48B с MLA KV Cache в llama.cpp: инструкция по сборке и экономия VRAM с 140GB до 15GB Пошаговая инструкция по сборке llama.cpp с поддержкой MLA KV Cache для запуска KimiLinear-48B на домашнем железе. Экономия видеопамяти в 10 раз. 8 мин чтения 7206 Chatterbox Extended и другие локальные инструменты для псевдо-конвертации голоса Сравнение Chatterbox Extended, RVC и других локальных инструментов для голосового клонирования по короткому аудио. Какое качество за 15 секунд? 6 мин чтения 7207 Трансформеры vs State-Space модели: какая архитектура устойчивее к атакам? Разбор исследования по adversarial robustness Новое исследование показывает, что State-Space модели, такие как Mamba, могут быть более устойчивы к adversarial атакам, чем трансформеры. Разбираем результаты 4 мин чтения 7208 MiniStral vs Gemma vs Qwen: какая модель до 15B справится с агентами, математикой и Raycast? Практическое сравнение MiniStral 3 14B, Gemma 3 12B и Qwen3-14B для агентных задач, математики и локального Raycast. Тесты, выбор, подводные камни. 9 мин чтения 7209 Провальный AI-автоответчик: кейс как плохой бот оттолкнул клиента и инструкция по созданию адекватного История как плохой AI-бот потерял клиента. Практическое руководство по созданию адекватного автоответчика. Дизайн чат-бота, промпты, обратная связь. 6 мин чтения 7210 Обзор Kreuzberg v4: как Rust-библиотека для обработки документов ускоряет RAG-пайплайны Обзор Kreuzberg v4 - Rust-библиотеки для извлечения текста, OCR, чанкинга и эмбеддингов. Ускоряет RAG-пайплайны, поддерживает 10 языков и плагины. 4 мин чтения 7211 Как создать качественный RAG: уроки из Kaggle-соревнования Data-Feeling-School-RAG-Challenge Разбор реального Kaggle-соревнования по RAG: детерминированность ответов, косинусное сходство эмбеддингов, оценка качества и подводные камни. 7 мин чтения 7212 Масштабирование LLM: как рассчитать инфраструктуру для 1000 одновременных запросов Практическое руководство по масштабированию LLM-сервисов: от расчёта GPU и памяти до архитектуры для 1000 RPS. vLLM, TGI, Continuous Batching. 8 мин чтения