Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

2253 материалов
01 MiniMax 2.7 на гибридной памяти 96GB VRAM + 192GB DDR5: тест производительности и техника REAP Тест производительности MiniMax 2.7 (172B) на связке 96GB VRAM + 192GB DDR5 с техникой REAP. Результаты: 47 токенов/с генерация, 1200 токенов/с префилл. Практич 7 мин чтения 02 Nvidia обещает 15x ускорение диффузионных моделей: что это значит для локального запуска? Nvidia анонсировала 15-кратное ускорение диффузионных моделей на новых чипах. Рассказываем, как это повлияет на генерацию изображений на домашних ПК. 3 мин чтения 03 OpenMythos: как новый бенчмарк разоблачает хваленые локальные LLM OpenMythos — открытый набор бенчмарков для локальных LLM. Разбираем, чем он лучше старых тестов, какие сюрпризы преподносит и почему без него не стоит выбирать 4 мин чтения 04 Claude Tag в Slack: цифровой сталкер или идеальный коллега? Anthropic запускает Claude Tag — AI-агента, который живет в Slack, помнит все и учится на ваших сообщениях. Разбираемся, как это работает и чем грозит приватнос 5 мин чтения 05 Дешевые API-модели на OpenRouter: скрытое квантование и экономика на примере GLM-5.2 Почему дешёвые модели на OpenRouter могут быть квантованы? Разбираем экономику FP8, H200 и реальную цену качества на примере GLM-5.2. 4 мин чтения 06 Карта китайских стартапов AI-чипов: кто уже поставляет H100/H200-класс и вышел на IPO Гайд по китайским производителям AI-чипов: Huawei, Biren, Cambricon, Enflame и другие. Кто реально поставляет аналоги H100/H200 и какие компании уже вышли на би 4 мин чтения 07 Разбор бага Codex: как AI-агент уничтожал SSD логами и как это исправить Инженеры обнаружили, что AI-агент на базе Codex записывал 640 ТБ в год на SSD из-за write amplification. Разбираем причины и даем решения. 4 мин чтения 08 Безопасность ИИ-агентов: почему system prompt не защищает и что делать System prompt — бумажный замок. Разбираем, почему промпт-инъекции обходят любые инструкции, и как защитить агентов на уровне рантайма. Примеры из реальных атак 5 мин чтения 09 KiSinWi: AutoML на мультиагентах — кто тут главный? Обзор платформы KiSinWi с LLM-агентами вместо пайплайнов. Реальные тесты на датасетах, сравнение с AutoGluon и H2O. Кто выиграл? 5 мин чтения 10 EU AI Act: обязательное водяное маркирование текста с августа 2025 — что нужно знать разработчикам и провайдерам Разбираемся с требованиями EU AI Act по маркировке AI-текста: технические сложности, штрафы, лазейки для open-source и влияние на российских разработчиков. Акту 4 мин чтения 11 Google DeepMind инвестирует $75 млн в A24: что это значит для AI в киноиндустрии Google DeepMind вкладывает $75 млн в студию A24. Разбираемся, как эти деньги изменят кинопроизводство, кто ещё играет на этом поле и почему независимое кино — и 5 мин чтения 12 Mythos под замком: как правительство США остановило экспорт ИИ-модели Anthropic Разбираемся, почему правительство США признало Mythos угрозой нацбезопасности и ввело экспортный контроль. История конфликта Anthropic и регуляторов. 4 мин чтения