Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
4081
AI-агенты работают как попало? Автоматические бенчмарки на Langfuse поставят их на место
Пошаговая система автоматической оценки качества AI-агентов с метриками, трейсингом и алерт-правилами. Практический гайд на Langfuse для продакшн-команд.
4082
Обзор лучших LLM-моделей для программирования на Macbook M5 Pro: тесты производительности и квантования
Практический гайд по выбору и запуску локальных LLM для программирования на Macbook Pro M5. Сравнение DeepSeek-Coder, Qwen2.5-Coder, GPT-OSS-20B, настройка LM S
4083
Гибридное внимание против полного: как MiniMax вскрыла архитектурные слабости, а Qwen3.5 обыгрывает DeepSeek V3.2
Анализ скрытых недостатков гибридного внимания из статьи MiniMax. Почему Qwen3.5 с полным вниманием выигрывает у DeepSeek V3.2 в многозадачном рассуждении на 02
4084
Context Engineering для coding-агентов: как управлять памятью Claude Code на длинных задачах (на примере CLAUDE.md и Plan Mode)
Как избежать деградации coding-агентов на длинных задачах. Методики context engineering, CLAUDE.md, Plan Mode. Пошаговый гайд на 2026 год с актуальными данными.
4085
Будущее junior-разработчиков в эпоху ИИ-кодинга: как изменится карьерный путь и чему учиться сейчас
Куда исчезают junior-позиции в IT и какие новые роли появятся вместо них. Практические советы по обучению и карьерному пути для начинающих в 2026 году.
4086
Jan-Code-4B: как установить и настроить легкую локальную модель для замены Claude Haiku в кодинге
Полный гайд по установке Jan-Code-4B — быстрой локальной модели для генерации кода. Замена Claude Haiku без платежей и слежки. Настройки, сравнения, примеры.
4087
AVA: ваш личный робот-секретарь, который ненавидит спам-звонки так же, как и вы
Как развернуть open-source AVA для борьбы со спам-звонками на своём GPU. Whisper, LLM и TTS локально. Полная приватность, нулевые задержки.
4088
Настройка Qwen 3.5 в llama.cpp: почему bf16 KV cache критически важен для точности
Пошаговое руководство по настройке Qwen 3.5 в llama.cpp с bf16 KV cache. Замеры perplexity, ошибки и оптимизация памяти. Актуально на 2026 год.
4089
Easy-torch-tpu: гайд по обучению больших PyTorch-моделей на Google TPU с нуля
Полный обзор фреймворка easy-torch-tpu для обучения LLM на Google TPU. Сравнение с PyTorch/XLA, примеры кода, интеграция с Hugging Face. Актуально на март 2026.
4090
Lila-E8: как геометрия группы Ли E8 заменяет Attention в трансформерах — обзор модели и инструкция по запуску
Обзор Lila-E8 — архитектуры, использующей геометрию группы Ли E8 для замены механизма внимания в трансформерах. Сравнение, примеры использования, инструкция по
4091
Полное руководство по AI Red Teaming: как взломали инфраструктуру Grok от xAI
Глубокий разбор атаки на инфраструктуру Grok. Методология AI Red Teaming, извлечение системного промпта, jailbreaks, CSRF, WAF bypass и пошаговый план защиты LL
4092
Инъекция навыков в KV-кэш: техника для экономии контекста в маленьких LLM
Как инъекция семантических навыков в KV-кэш решает проблему нехватки контекста для маленьких моделей вроде Qwen2.5 0.5B. Сравнение с markdown-файлами и примеры