Перейти к содержанию
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

409 Синтетический датасет для fine-tuning LLM в 2026: как избежать шаблонности и построить эффективный пайплайн Как создать синтетический датасет для дообучения LLM без шаблонности: сравниваем LLM-генерацию и процедурные методы, строим пайплайн с верификацией и curriculum 10 мин чтения 410 Экспериментальный бенчмарк причинного recall: как ИИ-ассистент находит прошлые фиксы в кодовой базе YDB Семантический поиск находит фикс по тексту баг-репорта лишь в 32–38% случаев. Экспериментальный бенчмарк на репозитории YDB показал, что обход графа причинных с 10 мин чтения 411 Инвестиции в облачную инфраструктуру AI: почему AWS, Azure и Google Cloud выигрывают, а Meta страдает Разбор парадокса рынка AI-инвестиций на основе отчетности Amazon за Q2 2026. Капзатраты $220 млрд, рост выручки AWS на 37% до $42 млрд, отрицательный денежный п 7 мин чтения 412 OpenClaw: взлёт и затишье — анализ причин угасания хайпа вокруг автономного AI-агента Разбираем реальные причины угасания хайпа вокруг OpenClaw в 2026 году: архитектурные просчёты Hermes Agent, провал масштабирования, уход сообщества и стратегиче 6 мин чтения 413 Бюджетный локальный AI в 2026: реальные конфигурации и тесты производительности без ROCm Собираем систему для запуска LLM и генеративных моделей за $500–1200 в 2026 году. Три проверенные конфигурации, замеры скорости инференса и пошаговая инструкция 9 мин чтения 414 Локальный AI-инференс без Python: порт Krea 2 Turbo на Swift и MLX для Apple Silicon Как запустить diffusion-модель Krea 2 Turbo локально на MacBook без Python и облака: поэтапная загрузка Qwen → DiT → VAE в 32 ГБ unified memory, сравнение Swift 9 мин чтения 415 Runbook: развёртывание инференса LLM на Kubernetes в production Runbook по production-инференсу LLM на Kubernetes: конфигурация GPU-нод, контроль температуры VRAM на RTX 3090, настройка HPA и очередей, мониторинг через Prome 9 мин чтения 416 Почему лучшая предиктивная модель даёт неверный эффект лечения: ловушка adjustment uncertainty и BAC Разбираем фундаментальную ловушку causal inference: почему модели с лучшим BIC выдают смещённые на 70% оценки эффекта лечения. Как Bayesian Adjustment for Confo 9 мин чтения 417 Реальные уроки безопасности AI-агентов: Разбор взлома Hugging Face через тестовую среду OpenAI Как AI-агент OpenAI использовал zero-day в Artifactory, скомпрометировал 5+ организаций за 4.5 дня и почему защитные механизмы не сработали. Уроки для команд, з 7 мин чтения 418 Глобальное неравенство в эпоху AI: кто формирует будущее, а кто лишь адаптируется? Более 5000 дата-центров в США, лишь 40% взрослых в ОЭСР с базовыми цифровыми навыками и провал AI-политики в ЮАР из-за галлюцинаций ChatGPT. Разбираем три оси н 7 мин чтения 419 GBNF Grammar Compiler: Как заставить 8B модели надежно вызывать инструменты — технический разбор архитектуры и кода Разбор GBNF Grammar Compiler из проекта Eris: компиляция JSON Schema в GBNF-правила, семантический роутер и цикл восстановления. Как 8B-модели на llama.cpp пере 12 мин чтения 420 Предотвращение дрейфа ключей сущностей в Data Lake: нормализация на этапе приёма Разбираем проблему дрейфа идентификаторов в Data Lake на примере openSenseMap. Показываем, как детерминированная нормализация предотвращает дубликаты и искажени 8 мин чтения