Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

6721 GLM 4.5 Air в режиме тупняка: как выжать максимум скорости с enable_thinking: false Полное руководство по настройке GLM 4.5 Air с enable_thinking: false. Параметры unsloth, ускорение inference, исправление ошибок генерации. 6 мин чтения 6722 Ministral 3 без цензуры и с глазами: как запустить разблокированную визуальную модель на домашнем железе Полный гайд по запуску разблокированной Ministral 3 с поддержкой Vision. Сравнение квантований Q4, Q5, Q8, BF16 для моделей 4B, 8B, 14B. Установка через Hugging 5 мин чтения 6723 Замена Claude Code для команды разработчиков: сравнение локальных альтернатив, стоимость и производительность Полное руководство по замене дорогого Claude Code на локальные модели для команды. Сравнение Deepseek Coder, CodeLlama, настройка vLLM сервера, квантование Q8 и 9 мин чтения 6724 Agent-memory-state: когда ваш AI-агент наконец запомнит, что вы говорили вчера Обзор agent-memory-state — Python библиотеки для управления памятью AI-агентов по паттерну OpenAI Cookbook. Примеры кода, сравнения, практическое применение. 6 мин чтения 6725 RLM-Toolkit: полный гайд по работе с контекстом 10M+ токенов, установка, архитектура и безопасность Подробный обзор RLM-Toolkit для длинного контекста LLM. Установка pip, сравнение с аналогами, архитектура H-MEM и InfiniRetri, примеры кода и roadmap. 6 мин чтения 6726 HeartMula 3B: локальный Suno, который требует видеокарту за 2000$ Обзор HeartMula 3B — локального генератора музыки. Требования к железу (21.7 ГБ VRAM), сравнение качества с Suno и Udio, практические примеры. 3 мин чтения 6727 Как интегрировать локальную LLM в игру S.T.A.L.K.E.R. Anomaly: туториал по созданию динамических событий Пошаговое руководство по подключению локальной LLM к S.T.A.L.K.E.R. Anomaly для генерации уникальных игровых событий. Proof of concept для моддеров и разработчи 7 мин чтения 6728 Когда миллион писем должен стать контекстом для AI-агента: индустриальный гайд по реконструкции тредов, парсингу вложений и работе с 15 языками Глубокий технический разбор обработки email для AI-агентов. Реконструкция тредов, работа с вложениями (OCR, парсинг), мультиязычные данные, zero data retention. 13 мин чтения 6729 Апгрейд железа для 30B моделей: сравниваем Mac Mini M2 Pro, серверные Xeon и гибридные сборки в бюджете $600 Практический гайд по апгрейду для запуска 30B моделей (Qwen2.5 30B) на бюджет $600. Сравнение Mac Mini M2 Pro, серверных Xeon и гибридных сборок. 8 мин чтения 6730 Эксперимент с автономным AI-разработчиком: как настроить workflow с генерацией тестов и исправлением багов Практический гайд по настройке автономного цикла разработки с AI. Используем GPT/Claude через Verdant для генерации тестов и исправления багов. Затраты, ошибки, 9 мин чтения 6731 Newelle 1.2: Полное руководство по настройке AI-ассистента с llama.cpp, гибридным поиском и семантической памятью на Linux Пошаговое руководство по установке Newelle 1.2 на Linux. Настройка llama.cpp, гибридного поиска, семантической памяти и инструментов команд MCP. 8 мин чтения 6732 EmoCore: Как внедрить детерминированный губернатор для контроля бюджета риска и усилий в автономных AI-агентах Обзор EmoCore - системы контроля бюджета риска и усилий для автономных AI-агентов. Как предотвратить runaway-поведение и бесконечные циклы. 6 мин чтения