Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

1801 Сжатие контекста в Codex CLI и Claude Code: миф о миллионе токенов и реальная эффективность Почему Codex CLI эффективнее сжимает контекст, чем Claude Code с его 1M токенов. Технический разбор механизмов, разоблачение маркетинга Anthropic. 8 мин чтения 1802 Почему автоматические метрики перевода обманчивы: случай TranslateGemma-12b — 71% чистых сегментов оказались плохими Исследование показало: TranslateGemma-12b получает высокие баллы по BLEU и COMET, но люди бракуют 71% переводов. Разбираем, почему автоматические метрики не раб 4 мин чтения 1803 Почему короткий промпт может быть дороже длинного: разбор prefix cache в LLM-агентах Разбираем парадокс: ужимая промпт для агентов, вы теряете преимущества prefix caching. Рассказываю, как логировать кэш, не стрелять себе в ногу и экономить до 9 6 мин чтения 1804 OpenAI Daybreak: GPT-5.5 и Codex научились самостоятельно искать и чинить уязвимости — три уровня доступа OpenAI анонсировала Daybreak — связку GPT-5.5-Cyber и Codex для автономного поиска и патчинга уязвимостей. Три уровня доступа, phishing-resistant аутентификация 5 мин чтения 1805 Вайбкодинг по-взрослому: как я вывел MVP из головы в прод за 3 дня (и что пошло не так) Пошаговый гайд по вайбкодингу с Claude Code и Codex. Реальные ошибки, оптимизация WebM, деплой на OpenServer. Личный опыт с 26-летним стажем. 8 мин чтения 1806 Как создать мультиклиентский центр управления для AI-агентов: Planulix на Go и Flutter Соберите собственный центр управления для Claude Code, Cursor, Codex и Kimi. Go-шлюз, Flutter UI, VPS — решение проблемы блокировок аккаунтов. Полный гайд с код 8 мин чтения 1807 Как развернуть Ollama и Open WebUI на VPS без GPU: полный гайд с подводными камнями Пошаговое руководство по запуску самодельного ChatGPT на CPU VPS с Docker, Ollama, Open WebUI, nginx и SSL. Подводные камни, оптимизация памяти и выбор модели. 10 мин чтения 1808 Как прикрутить веб-поиск к AI-агенту: Strands Agents SDK + Exa — пошаговое пособие для тех, кто устал от галлюцинаций Полный гайд по интеграции Strands Agents SDK (AWS) и Exa для AI-агентов с веб-доступом. Код, примеры, ошибки и советы для production. 9 мин чтения 1809 llama.cpp server: долгожданное исправление краша mmproj + MTP (speculative decoding) Узнайте, как в llama.cpp server наконец починили краш при использовании mmproj с многотокенной спекуляцией. Практические советы и прогнозы. 4 мин чтения 1810 Запуск модели с 500k контекстом на 48GB VRAM: Nemotron-3-Super 64B-A12B и скорость 21 tok/s Обзор модели Nemotron-3-Super 64B-A12B: 500k токенов контекста на 48GB VRAM, 21 токен/с. MoE, GGUF квантование, агентное кодирование. Сравнение с альтернативами 4 мин чтения 1811 Как локальные модели ломают JSON: каталог ошибок и библиотека для восстановления Разбираем типичные сбои JSON-вывода у локальных моделей (Llama, Qwen, Mistral) и показываем, как библиотека Loot-JSN их чинит. Примеры, код, сравнение. 6 мин чтения 1812 Claude Platform on AWS: Полный гайд по настройке, IAM и биллингу Как подключить Claude через AWS Marketplace, настроить IAM-аутентификацию, управлять агентами и отслеживать затраты. Полное руководство с примерами. 6 мин чтения