Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
3649
DeepSeek 671B за $2000 дома: полный гайд по сборке сервера, квантованию и запуску гигантской модели
Пошаговый гайд по сборке бюджетного сервера для запуска DeepSeek V3.2 671B дома. Подбор железа, квантование модели и настройка за $2000.
3650
Как настроить гибридный workflow Cloud Architect + Local Builder для автоматизации кода с OpenCode
Настройте экономичный workflow: GPT-5.4 планирует, Qwen Coder пишет код. Подробный гайд по автоматизации разработки с OpenCode.
3651
RLM против Hermes Agent: сравнительный анализ подходов к управлению контекстом в AI-агентах
Глубокий разбор архитектур RLM и Hermes Agent для управления контекстом. Сравнительная таблица, выбор подхода для масштабируемых систем на 2026 год.
3652
Autoresearch Карпати в 2026: когда ИИ исследует сам себя
Разбираем autoresearch Карпати - систему автономных ML-экспериментов. Актуально на март 2026: установка, примеры, сравнение с альтернативами.
3653
Как настроить OmniCoder-9B для 100% HumanEval на домашнем ПК: полный гайд по llama.cpp
Пошаговая инструкция по настройке OmniCoder-9B для достижения 100% на HumanEval с помощью llama.cpp на домашнем ПК с RTX 3080. Квантование Q6_K, оптимизация про
3654
IndexCache для vLLM/SGLang: Ускоряем DeepSeek-V3.2 до 1.8x за счёт кеширования индексов внимания
Патч IndexCache для vLLM и SGLang ускоряет sparse attention в DeepSeek-V3.2 до 1.82x, сокращая время prefill для больших контекстов.
3655
NumbyAI: Готовый пайплайн для категоризации транзакций через локальную LLM в Ollama
Пошаговый гайд по созданию пайплайна для автоматической категоризации банковских транзакций с использованием локальной LLM qwen3.5:9b в Ollama. Готовое решение
3656
LocoTrainer-4B: как установить и использовать экспертного агента для фреймворка MS-SWIFT
Полное руководство по установке и использованию LocoTrainer-4B - экспертного агента для тонкой настройки моделей в фреймворке MS-SWIFT. Сравнение, примеры, реко
3657
Shinka Evolve: когда эволюционные алгоритмы и LLM рождают программы, которые пугают своих создателей
Разбор фреймворка Shinka Evolve из подкаста MLST: как эволюционные алгоритмы и LLM ведут открытый поиск программ. AlphaEvolve устарел, качественно-разнообразный
3658
Multi-agent системы: разоблачение хайпа и реальная польза для инженерии
Почему swarm intelligence — это миф, а multi-agent системы работают за счет декомпозиции задач. Анализ инструментов и практик на март 2026.
3659
Local Personality Engine: NPC, которые помнят, что вы им сказали вчера
Экспериментальный фреймворк для создания выразительных и безопасных AI-агентов с горячей заменой поведения. Интеграция с Ollama и игровыми движками.
3660
Запуск Whisper, дизаризации и суммаризации на iPhone Neural Engine: полный on-device пайплайн без облака
Запустите Whisper и LLM для транскрипции и суммаризации аудио на iPhone Neural Engine. Полное руководство по on-device пайплайну без интернета.