Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
6721
GLM 4.5 Air в режиме тупняка: как выжать максимум скорости с enable_thinking: false
Полное руководство по настройке GLM 4.5 Air с enable_thinking: false. Параметры unsloth, ускорение inference, исправление ошибок генерации.
6722
Ministral 3 без цензуры и с глазами: как запустить разблокированную визуальную модель на домашнем железе
Полный гайд по запуску разблокированной Ministral 3 с поддержкой Vision. Сравнение квантований Q4, Q5, Q8, BF16 для моделей 4B, 8B, 14B. Установка через Hugging
6723
Замена Claude Code для команды разработчиков: сравнение локальных альтернатив, стоимость и производительность
Полное руководство по замене дорогого Claude Code на локальные модели для команды. Сравнение Deepseek Coder, CodeLlama, настройка vLLM сервера, квантование Q8 и
6724
Agent-memory-state: когда ваш AI-агент наконец запомнит, что вы говорили вчера
Обзор agent-memory-state — Python библиотеки для управления памятью AI-агентов по паттерну OpenAI Cookbook. Примеры кода, сравнения, практическое применение.
6725
RLM-Toolkit: полный гайд по работе с контекстом 10M+ токенов, установка, архитектура и безопасность
Подробный обзор RLM-Toolkit для длинного контекста LLM. Установка pip, сравнение с аналогами, архитектура H-MEM и InfiniRetri, примеры кода и roadmap.
6726
HeartMula 3B: локальный Suno, который требует видеокарту за 2000$
Обзор HeartMula 3B — локального генератора музыки. Требования к железу (21.7 ГБ VRAM), сравнение качества с Suno и Udio, практические примеры.
6727
Как интегрировать локальную LLM в игру S.T.A.L.K.E.R. Anomaly: туториал по созданию динамических событий
Пошаговое руководство по подключению локальной LLM к S.T.A.L.K.E.R. Anomaly для генерации уникальных игровых событий. Proof of concept для моддеров и разработчи
6728
Когда миллион писем должен стать контекстом для AI-агента: индустриальный гайд по реконструкции тредов, парсингу вложений и работе с 15 языками
Глубокий технический разбор обработки email для AI-агентов. Реконструкция тредов, работа с вложениями (OCR, парсинг), мультиязычные данные, zero data retention.
6729
Апгрейд железа для 30B моделей: сравниваем Mac Mini M2 Pro, серверные Xeon и гибридные сборки в бюджете $600
Практический гайд по апгрейду для запуска 30B моделей (Qwen2.5 30B) на бюджет $600. Сравнение Mac Mini M2 Pro, серверных Xeon и гибридных сборок.
6730
Эксперимент с автономным AI-разработчиком: как настроить workflow с генерацией тестов и исправлением багов
Практический гайд по настройке автономного цикла разработки с AI. Используем GPT/Claude через Verdant для генерации тестов и исправления багов. Затраты, ошибки,
6731
Newelle 1.2: Полное руководство по настройке AI-ассистента с llama.cpp, гибридным поиском и семантической памятью на Linux
Пошаговое руководство по установке Newelle 1.2 на Linux. Настройка llama.cpp, гибридного поиска, семантической памяти и инструментов команд MCP.
6732
EmoCore: Как внедрить детерминированный губернатор для контроля бюджета риска и усилий в автономных AI-агентах
Обзор EmoCore - системы контроля бюджета риска и усилий для автономных AI-агентов. Как предотвратить runaway-поведение и бесконечные циклы.