Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
3217
SillyTavern AI Game Master: расширение для интеграции LLM в любую игру
Технический разбор SillyTavern AI Game Master - расширения для интеграции локальных LLM (Cydonia, Qwen 3.5) в любую игру. Архитектура, клонирование голоса, срав
3218
Полный гайд по горячим клавишам Claude Code: ускорьте работу в терминальном AI-инструменте
Исчерпывающий гайд по всем горячим клавишам и слэш-командам Claude Code. Установка, настройка и рабочие процессы для разработчиков в 2026 году.
3219
NGT Memory: установка и использование open-source модуля персистентной памяти для LLM
Полный обзор NGT Memory — open-source модуля персистентной памяти для LLM. Установка через Docker, три механизма извлечения данных, сравнение с Mem0 и Mengram,
3220
MolmoWeb 8B: как запустить мультимодального веб-агента, который превосходит GPT-4o
Обзор и инструкция по запуску MolmoWeb 8B — открытого мультимодального агента, который бьет GPT-4o в веб-автоматизации. Архитектура, примеры, сравнение.
3221
Атака на цепочку поставок: компрометация пакетов LiteLLM в PyPI
Критическая уязвимость в цепочке поставок AI: вредоносные пакеты LiteLLM обнаружены в PyPI. Как проверить свои проекты и защитить данные.
3222
Проблемы разработки MoE-моделей: как GigaChat победил зацикливание и оптимизировал DPO в FP8
Разбор реальных проблем разработки MoE-моделей: зацикливание генераций, баг в SGLang, и решения от команды GigaChat: метрика на BPE-сжатии, переход на нативный
3223
Как квантование KV-кеша влияет на код: результаты SWE-bench и воспроизводимый стенд
SWE-bench доказал: квантование KV-кеша до 4 бит почти не вредит коду. Глубокий разбор методологии, таблицы результатов и готовый Docker Compose для проверки.
3224
Полное руководство по локальному запуску DeepSeek R1: от выбора сервера до настройки конфигов
Пошаговое руководство по локальному запуску DeepSeek R1. Выбор железа, настройка окружения, конфиги, оптимизация производительности и решение проблем.
3225
Qwen3.5 Neo: обзор эффективных fine-tune моделей для быстрого Chain-of-Thought
Обзор Qwen3.5 Neo моделей, оптимизированных для быстрого Chain-of-Thought reasoning. Экономия токенов, сравнение с альтернативами, примеры использования на 24.0
3226
Взломаный Claude Code: как сообщество собрало SDK без зависимостей и зачем он вам
Гайд по использованию обратно спроектированного Claude Code SDK с zero dependencies. Установка на 4 языках, работа с агентами, инструментами и MCP.
3227
Архитектура перманентного локального агента: гибридная память, экономия токенов и лестница моделей на примере Mac mini
Как построить AI-агента с памятью на Mac mini. Гибридный поиск BM25, экономия токенов, лестница моделей для эффективности. Подробное руководство.
3228
Memento v1.0: Забудьте о золотых рыбках — ваш AI-агент теперь помнит все
Полное руководство по развертыванию Memento v1.0 — локальной памяти для AI-агентов. Установка в одну команду, офлайн эмбеддинги, HNSW индекс. Для приватных прое