Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
6145
Почему автономные AI-агенты ломаются в Kubernetes: разбор слоёв сложности и эксперимент
Глубокий разбор проблем автономных AI-агентов в Kubernetes на примере Yandex Cloud. Слои сложности, декларативная модель и практические решения на 2026 год.
6146
Битрикс24 встречает ИИ: собираем стартер-пак для умной разработки
Готовое техническое решение для интеграции AI-агентов в Битрикс24. Стартер-пак, токены авторизации, REST API и тиражируемые продукты.
6147
Фреймворки для AI-агентов в 2025: Autogen против LangChain, OpenHands и остальных
Подробный разбор фреймворков для AI-агентов на 2025 год: архитектура, boilerplate-код, производительность. Что выбрать для проекта?
6148
Как создать техническое задание, которое не решат ИИ: кейс Anthropic и тесты для разработчиков
Как Anthropic создает тестовые задания, которые не решает Claude 4.5. Практическое руководство для тимлидов и HR по оценке реальных навыков разработчиков.
6149
Cognitive OS: локальная IDE для мультиагентных workflow с графом знаний
Архитектура локальной IDE для управления AI-агентами с персистентным состоянием, графом знаний и JIT-инъекцией контекста. Обзор на 26.01.2026.
6150
ИИ задаст вам вопросы: метод Стэнфорда, который переворачивает диалог с нейросетью
Системный промпт для ChatGPT и Claude, который заставляет ИИ задавать вам вопросы. Метод Стэнфорда для креативности и самоанализа с примерами.
6151
Как настройка `--threads -1` в llama.cpp ломает производительность GLM-4.7: разбор бага и оптимизация
Подробный разбор бага с параметром --threads -1 в llama.cpp для GLM-4.7. Объясняем, почему автоматическое определение потоков ломает производительность, и даем
6152
Fine-tuning и квантование Qwen2.5-0.5B для классификации обращений: пошаговый гайд для бизнеса
Полный гайд по fine-tuning Qwen2.5-0.5B для классификации обращений, квантованию до 350 MB и деплою на дешёвый VPS. Экономия с $200 до $10 в месяц.
6153
RAG в 2026: хакеры атакуют, таблицы сопротивляются, а фейки процветают
Обзор последних исследований RAG на 26.01.2026: новые атаки на системы, прорыв в поиске по таблицам и борьба с фейк-ньюс. Актуальные данные и методы.
6154
256k контекст на 8 x 5070 Ti: как выбрать и запустить Large Context Model для технических суммаризаций
Практическое руководство по выбору и запуску моделей с контекстом 256k-512k для суммаризации технических документов. Аппаратные требования, сравнение моделей, о
6155
Когда Ollama зависает на полуслове: как настроить таймауты и логирование для генерации сложного кода
Практическое руководство по настройке таймаутов, логированию ошибок и оптимизации Ollama с Continue для генерации сложного кода на локальных LLM. Решаем проблем
6156
Суверенный агент на Neo4j RAG с автономными циклами: полный гайд для Apple Silicon
Пошаговая архитектура автономного агента с Neo4j RAG, ChromaDB и гибридной памятью для Mac M1/M2/M3. Полный стек на 26.01.2026.