Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

1513 POML: воскрешение модульных промпт-шаблонов в VS Code с локальным AI Обновленное расширение POML для VS Code: модульные шаблоны промптов, HTML-разметка, поддержка OpenAI и локальных LLM. Обзор, примеры и сравнение с альтернативам 6 мин чтения 1514 Три критика и один судья: как мы строили multi-agent фидбек для художников (и во сколько это обошлось) Разбор архитектуры multi-agent feedback для художников: 3 LLM-персоны + судья, компромиссы, стоимость токенов и реальные метрики. Опыт продакшна. 6 мин чтения 1515 Почему традиционные таск-трекеры умирают: как AI-агенты и Claude Code меняют рынок Рынок традиционных трекеров задач рухнул на $285 млрд. Claude Code, вайб-кодинг и Agentic Engineering превращают таск-трекеры в пережиток. Прогноз до 2027 года. 1 мин чтения 1516 Am I OpenAI compatible: как проверить, обманывает ли вас локальная модель Open-source инструмент для тестирования совместимости API локальных AI-моделей с OpenAI. Примеры, сравнение, бенчмарки. Кому и зачем это нужно. 5 мин чтения 1517 Claudex: как запустить Claude Code без API ключа через ChatGPT/Codex OAuth Запустите Claude Code используя подписку ChatGPT. Open-source утилита Claudex использует OAuth от Codex. Установка, настройка, сравнение. 4 мин чтения 1518 Seedream и Seedance: Как ByteDance переписала правила игры и оказалась на скамье подсудимых Разбор технологий Seedream и Seedance, обвинения в плагиате со стороны Голливуда, уникальная архитектура и почему модели ByteDance обходят Midjourney. 3 мин чтения 1519 Как избежать роста latency и перегрева GPU: проектирование AI-сервисов с изолированным inference bundle Практическое руководство по проектированию AI-сервисов с изолированным inference bundle. vLLM, SGLang, continuous batching — как избежать просадок производитель 9 мин чтения 1520 Schema-enforced execution с tool_use: как повысить надежность структурированных ответов Claude до 95% Гайд по schema-enforced execution и tool_use Claude: поднимаем надежность структурированных ответов с 65% до 95%+. Примеры кода, ловушки и evals. 8 мин чтения 1521 AMD BC-250 для дешёвого локального LLM: разблокировка CUs через регистры amdgpu Как превратить $30 карту на чипе PS5 в 36-ядерный AI-ускоритель. Регистр CC_GC_SHADER_ARRAY_CONFIG, прошивка VBIOS, сборка llama.cpp с Vulkan — полный гайд 2026 9 мин чтения 1522 Performance Boost: How to Build llama.cpp with PDL for NVIDIA GPUs (Build 9254) Пошаговый гайд по сборке llama.cpp (Build 9254) с флагом PDL для NVIDIA GPU. Исправляем регрессию TG и ускоряем инференс Qwen3.6 до 30%. 5 мин чтения 1523 Развертывание real-time ASR с Voxtral-Mini-4B на Amazon SageMaker и vLLM: пошаговое руководство Пошаговый гайд по запуску Voxtral-Mini-4B на SageMaker с vLLM: bidirectional streaming, WebSocket, настройка инстансов, типичные ошибки и их решение. 8 мин чтения 1524 Слух: Qwen готовит модель 27B для локального запуска Сообщество локальных LLM гудит: Qwen разрабатывает модель 27B, идеальную для запуска на одной видеокарте. Пока без официального подтверждения, но инсайды выгляд 3 мин чтения