Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

5365 График METR — это не экспонента: почему ИИ развивается медленнее, чем кажется Разбираем главный график в ИИ-сообществе — временной горизонт METR. Почему его неверно интерпретируют и как на самом деле растут способности ИИ в 2026 году. 4 мин чтения 5366 Нейро-дайджест: Китайские SOTA-модели атакуют, Codex на десктопе и бесплатный аналог Suno Обзор последних AI-новинок: китайские модели для кода Qwen3-Coder-Next и Lucy 2.0, бесплатный аналог Suno ACE-Step 1.5 и десктопное приложение Codex от OpenAI. 4 мин чтения 5367 Qwen3-Coder-Next в Ollama: хватит ли 128 ГБ RAM и зачем нужен q8_0 Подробное руководство по запуску qwen3-coder-next в Ollama 0.15.5: сравнение квантований q4_K_M и q8_0, требования к видеопамяти (80 ГБ) и оперативной памяти (1 5 мин чтения 5368 Когда ИИ ошибается не фактом, а мыслью: почему логические сбои убивают доверие к нейросетям Новые исследования показывают: ошибки в рассуждениях LLM опаснее фактологических. Анализ моделей GPT-5, Gemini 3.0 Ultra и Claude 4.0 в медицине и праве. 6 мин чтения 5369 Prompt Fidelity: почему ваш AI-агент вас не слушается и как это измерить Что такое верность промпта, как измерить точность выполнения инструкций AI-агентами на примере Spotify и какие метрики использовать для оценки качества работы а 7 мин чтения 5370 Внутреннее устройство Claude Opus 4.6: «исповедь» модели о ядре, эмбеддингах и атаках Эксперимент с промпт-инжинирингом: заставляем Claude Opus 4.6 описать свою архитектуру. Технические метафоры, эмбеддинги, уязвимости. 8 мин чтения 5371 ArkOS: когда твой локальный AI-агент наконец перестанет страдать амнезией Разбираем ArkOS — opensource-фреймворк для локальных AI-агентов с персистентной памятью, explicit state graphs и полным контролем. Обзор архитектуры, сравнение 8 мин чтения 5372 Парето-фронт LLM в 2026: карта, где деньги встречают интеллект Практическое руководство по выбору LLM в 2026 году. Сравнение стоимости инференса на OpenRouter с качеством по ELO-рейтингу LMSys. Парето-оптимальные модели. 8 мин чтения 5373 От Data Scientist к AI Engineer: смена парадигмы с «модель хороша» на «система выживет в бою» Почему Data Scientist умирает, а AI Engineer расцветает. Практический гайд по смене мышления, инструменты MLOps и как строить системы, которые выживают в бою. 8 мин чтения 5374 Claude + WordPress: как настроить интеграцию и использовать промпты для анализа сайта Пошаговый гайд по настройке Claude с WordPress через MCP. Анализ трафика, комментариев, SEO. Промпты для владельцев сайтов и контент-менеджеров. 6 мин чтения 5375 Google и DeepMind превратили ваш смартфон в motion capture-студию. И это работает Как Google Cloud и DeepMind создали платформу для биомеханического анализа по 2D видео. Технология заменяет дорогие motion capture системы. 4 мин чтения 5376 Opus 4.6 ворвался в право: как агентские рои Anthropic переписали правила игры Claude Opus 4.6 от Anthropic показал 29.8% в юридическом бенчмарке Mercor. Разбираем, как работают agent swarms и почему это прорыв для профессиональных AI-зада 7 мин чтения