Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

3217 SillyTavern AI Game Master: расширение для интеграции LLM в любую игру Технический разбор SillyTavern AI Game Master - расширения для интеграции локальных LLM (Cydonia, Qwen 3.5) в любую игру. Архитектура, клонирование голоса, срав 6 мин чтения 3218 Полный гайд по горячим клавишам Claude Code: ускорьте работу в терминальном AI-инструменте Исчерпывающий гайд по всем горячим клавишам и слэш-командам Claude Code. Установка, настройка и рабочие процессы для разработчиков в 2026 году. 6 мин чтения 3219 NGT Memory: установка и использование open-source модуля персистентной памяти для LLM Полный обзор NGT Memory — open-source модуля персистентной памяти для LLM. Установка через Docker, три механизма извлечения данных, сравнение с Mem0 и Mengram, 6 мин чтения 3220 MolmoWeb 8B: как запустить мультимодального веб-агента, который превосходит GPT-4o Обзор и инструкция по запуску MolmoWeb 8B — открытого мультимодального агента, который бьет GPT-4o в веб-автоматизации. Архитектура, примеры, сравнение. 5 мин чтения 3221 Атака на цепочку поставок: компрометация пакетов LiteLLM в PyPI Критическая уязвимость в цепочке поставок AI: вредоносные пакеты LiteLLM обнаружены в PyPI. Как проверить свои проекты и защитить данные. 4 мин чтения 3222 Проблемы разработки MoE-моделей: как GigaChat победил зацикливание и оптимизировал DPO в FP8 Разбор реальных проблем разработки MoE-моделей: зацикливание генераций, баг в SGLang, и решения от команды GigaChat: метрика на BPE-сжатии, переход на нативный 5 мин чтения 3223 Как квантование KV-кеша влияет на код: результаты SWE-bench и воспроизводимый стенд SWE-bench доказал: квантование KV-кеша до 4 бит почти не вредит коду. Глубокий разбор методологии, таблицы результатов и готовый Docker Compose для проверки. 7 мин чтения 3224 Полное руководство по локальному запуску DeepSeek R1: от выбора сервера до настройки конфигов Пошаговое руководство по локальному запуску DeepSeek R1. Выбор железа, настройка окружения, конфиги, оптимизация производительности и решение проблем. 9 мин чтения 3225 Qwen3.5 Neo: обзор эффективных fine-tune моделей для быстрого Chain-of-Thought Обзор Qwen3.5 Neo моделей, оптимизированных для быстрого Chain-of-Thought reasoning. Экономия токенов, сравнение с альтернативами, примеры использования на 24.0 5 мин чтения 3226 Взломаный Claude Code: как сообщество собрало SDK без зависимостей и зачем он вам Гайд по использованию обратно спроектированного Claude Code SDK с zero dependencies. Установка на 4 языках, работа с агентами, инструментами и MCP. 6 мин чтения 3227 Архитектура перманентного локального агента: гибридная память, экономия токенов и лестница моделей на примере Mac mini Как построить AI-агента с памятью на Mac mini. Гибридный поиск BM25, экономия токенов, лестница моделей для эффективности. Подробное руководство. 8 мин чтения 3228 Memento v1.0: Забудьте о золотых рыбках — ваш AI-агент теперь помнит все Полное руководство по развертыванию Memento v1.0 — локальной памяти для AI-агентов. Установка в одну команду, офлайн эмбеддинги, HNSW индекс. Для приватных прое 5 мин чтения