Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

6145 Почему автономные AI-агенты ломаются в Kubernetes: разбор слоёв сложности и эксперимент Глубокий разбор проблем автономных AI-агентов в Kubernetes на примере Yandex Cloud. Слои сложности, декларативная модель и практические решения на 2026 год. 7 мин чтения 6146 Битрикс24 встречает ИИ: собираем стартер-пак для умной разработки Готовое техническое решение для интеграции AI-агентов в Битрикс24. Стартер-пак, токены авторизации, REST API и тиражируемые продукты. 6 мин чтения 6147 Фреймворки для AI-агентов в 2025: Autogen против LangChain, OpenHands и остальных Подробный разбор фреймворков для AI-агентов на 2025 год: архитектура, boilerplate-код, производительность. Что выбрать для проекта? 9 мин чтения 6148 Как создать техническое задание, которое не решат ИИ: кейс Anthropic и тесты для разработчиков Как Anthropic создает тестовые задания, которые не решает Claude 4.5. Практическое руководство для тимлидов и HR по оценке реальных навыков разработчиков. 8 мин чтения 6149 Cognitive OS: локальная IDE для мультиагентных workflow с графом знаний Архитектура локальной IDE для управления AI-агентами с персистентным состоянием, графом знаний и JIT-инъекцией контекста. Обзор на 26.01.2026. 8 мин чтения 6150 ИИ задаст вам вопросы: метод Стэнфорда, который переворачивает диалог с нейросетью Системный промпт для ChatGPT и Claude, который заставляет ИИ задавать вам вопросы. Метод Стэнфорда для креативности и самоанализа с примерами. 7 мин чтения 6151 Как настройка `--threads -1` в llama.cpp ломает производительность GLM-4.7: разбор бага и оптимизация Подробный разбор бага с параметром --threads -1 в llama.cpp для GLM-4.7. Объясняем, почему автоматическое определение потоков ломает производительность, и даем 9 мин чтения 6152 Fine-tuning и квантование Qwen2.5-0.5B для классификации обращений: пошаговый гайд для бизнеса Полный гайд по fine-tuning Qwen2.5-0.5B для классификации обращений, квантованию до 350 MB и деплою на дешёвый VPS. Экономия с $200 до $10 в месяц. 7 мин чтения 6153 RAG в 2026: хакеры атакуют, таблицы сопротивляются, а фейки процветают Обзор последних исследований RAG на 26.01.2026: новые атаки на системы, прорыв в поиске по таблицам и борьба с фейк-ньюс. Актуальные данные и методы. 5 мин чтения 6154 256k контекст на 8 x 5070 Ti: как выбрать и запустить Large Context Model для технических суммаризаций Практическое руководство по выбору и запуску моделей с контекстом 256k-512k для суммаризации технических документов. Аппаратные требования, сравнение моделей, о 10 мин чтения 6155 Когда Ollama зависает на полуслове: как настроить таймауты и логирование для генерации сложного кода Практическое руководство по настройке таймаутов, логированию ошибок и оптимизации Ollama с Continue для генерации сложного кода на локальных LLM. Решаем проблем 10 мин чтения 6156 Суверенный агент на Neo4j RAG с автономными циклами: полный гайд для Apple Silicon Пошаговая архитектура автономного агента с Neo4j RAG, ChromaDB и гибридной памятью для Mac M1/M2/M3. Полный стек на 26.01.2026. 12 мин чтения