Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

4081 AI-агенты работают как попало? Автоматические бенчмарки на Langfuse поставят их на место Пошаговая система автоматической оценки качества AI-агентов с метриками, трейсингом и алерт-правилами. Практический гайд на Langfuse для продакшн-команд. 9 мин чтения 4082 Обзор лучших LLM-моделей для программирования на Macbook M5 Pro: тесты производительности и квантования Практический гайд по выбору и запуску локальных LLM для программирования на Macbook Pro M5. Сравнение DeepSeek-Coder, Qwen2.5-Coder, GPT-OSS-20B, настройка LM S 8 мин чтения 4083 Гибридное внимание против полного: как MiniMax вскрыла архитектурные слабости, а Qwen3.5 обыгрывает DeepSeek V3.2 Анализ скрытых недостатков гибридного внимания из статьи MiniMax. Почему Qwen3.5 с полным вниманием выигрывает у DeepSeek V3.2 в многозадачном рассуждении на 02 4 мин чтения 4084 Context Engineering для coding-агентов: как управлять памятью Claude Code на длинных задачах (на примере CLAUDE.md и Plan Mode) Как избежать деградации coding-агентов на длинных задачах. Методики context engineering, CLAUDE.md, Plan Mode. Пошаговый гайд на 2026 год с актуальными данными. 9 мин чтения 4085 Будущее junior-разработчиков в эпоху ИИ-кодинга: как изменится карьерный путь и чему учиться сейчас Куда исчезают junior-позиции в IT и какие новые роли появятся вместо них. Практические советы по обучению и карьерному пути для начинающих в 2026 году. 6 мин чтения 4086 Jan-Code-4B: как установить и настроить легкую локальную модель для замены Claude Haiku в кодинге Полный гайд по установке Jan-Code-4B — быстрой локальной модели для генерации кода. Замена Claude Haiku без платежей и слежки. Настройки, сравнения, примеры. 6 мин чтения 4087 AVA: ваш личный робот-секретарь, который ненавидит спам-звонки так же, как и вы Как развернуть open-source AVA для борьбы со спам-звонками на своём GPU. Whisper, LLM и TTS локально. Полная приватность, нулевые задержки. 6 мин чтения 4088 Настройка Qwen 3.5 в llama.cpp: почему bf16 KV cache критически важен для точности Пошаговое руководство по настройке Qwen 3.5 в llama.cpp с bf16 KV cache. Замеры perplexity, ошибки и оптимизация памяти. Актуально на 2026 год. 6 мин чтения 4089 Easy-torch-tpu: гайд по обучению больших PyTorch-моделей на Google TPU с нуля Полный обзор фреймворка easy-torch-tpu для обучения LLM на Google TPU. Сравнение с PyTorch/XLA, примеры кода, интеграция с Hugging Face. Актуально на март 2026. 6 мин чтения 4090 Lila-E8: как геометрия группы Ли E8 заменяет Attention в трансформерах — обзор модели и инструкция по запуску Обзор Lila-E8 — архитектуры, использующей геометрию группы Ли E8 для замены механизма внимания в трансформерах. Сравнение, примеры использования, инструкция по 6 мин чтения 4091 Полное руководство по AI Red Teaming: как взломали инфраструктуру Grok от xAI Глубокий разбор атаки на инфраструктуру Grok. Методология AI Red Teaming, извлечение системного промпта, jailbreaks, CSRF, WAF bypass и пошаговый план защиты LL 9 мин чтения 4092 Инъекция навыков в KV-кэш: техника для экономии контекста в маленьких LLM Как инъекция семантических навыков в KV-кэш решает проблему нехватки контекста для маленьких моделей вроде Qwen2.5 0.5B. Сравнение с markdown-файлами и примеры 5 мин чтения