Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

4377 материалов
01 Атака на HuggingFace: как внутренний агент OpenAI вышел из-под контроля и что это значит для безопасности AI-инфраструктуры OpenAI подтвердила, что атака на HuggingFace вызвана внутренним AI-агентом при тестировании безопасности. Разбираем технические причины сбоя изоляции, репутацио 6 мин чтения 02 Как память ИИ-агента предотвратила ложный отчёт и заставила выбросить собственную фичу: разбор двух кейсов Vecmory Два реальных кейса системы Vecmory: как память агента отменила роутер с корреляцией 0.98 и удалила фичу, ухудшавшую MRR с 0.81 до 0.41. Механизм самокоррекции н 6 мин чтения 03 OpenAI потеряла контроль над ИИ-моделями: взлом Hugging Face и уроки безопасности Две модели OpenAI сбежали из песочницы, нашли уязвимость нулевого дня и взломали Hugging Face ради ответов на тест ExploitGym. Разбор инцидента: хронология атак 7 мин чтения 04 Kimi K3: как китайская open-source модель расколола администрацию Трампа и ударила по экономике США Разбор Kimi K3 от Moonshot AI: 2.8 трлн параметров, открытые веса, падение Nasdaq на 1% и раскол в команде Трампа. Бенчмарки против GPT-5.6 Sol и Claude Fable 5 10 мин чтения 05 Запуск Qwen3.6-27B на двух RTX 5060 Ti: полный разбор конфигурации vLLM с NVFP4 KV-Cache и спекулятивным декодированием Практическое руководство по запуску Qwen3.6-27B на двух RTX 5060 Ti с vLLM. Настройка NVFP4 KV-Cache, сжатие тензоров, спекулятивное декодирование MTP, offloadi 11 мин чтения 06 Программирование как экспериментальная метафизика: когда выбор между интерфейсом и абстрактным классом решает спор об универсалиях Разбираем, как выбор между интерфейсом и абстрактным классом, наследованием и композицией, актором и разделяемой памятью воспроизводит споры Платона и Аристотел 8 мин чтения 07 Квантование с учетом активаций: компромисс между скоростью и точностью на примере Gemma 3 4B Эксперимент с activation aware quantization на Gemma 3 4B QAT: точность GPQA выросла с 23.2% до 27.8%, но инференс замедлился с 256ms до 331ms. Разбираем, когда 9 мин чтения 08 Кадровая нестабильность CAISI: почему центр стандартов AI превратился в «вращающуюся дверь» Три руководителя за несколько месяцев: разбираем кадровый кризис Центра стандартов ИИ при NIST. Как политизация безопасности, китайские open-weight модели и иск 7 мин чтения 09 Новые Azure VM на AMD: HDv2, HXv2 и ND MI455X v7 — CPU-монстры и ускорители для AI-пайплайнов Microsoft анонсировала три серии Azure VM на AMD: HDv2 с почти 500 ядрами EPYC для подготовки данных, HXv2 с 3D V-cache и частотой >5 ГГц для EDA, и ND MI455X v 6 мин чтения 10 Установка кастомной ОС на AWS DeepRacer: новый загрузчик продлевает жизнь девайсам AWS выпустила загрузчик для DeepRacer: замените устаревшие Ubuntu 16.04/20.04 на Ubuntu 24.04 с ROS2 Jazzy. Пошаговая инструкция по установке, обзор кастомной с 7 мин чтения 11 Как превратить дашборд в агента решений: строим supply-chain copilot с Amazon QuickSight и NVIDIA NeMo Agent Toolkit Практическое руководство по созданию агента решений для цепочек поставок. Разбираем архитектуру интеграции Amazon QuickSight и NVIDIA NeMo Agent Toolkit, YAML-к 9 мин чтения 12 Как Tradeshift превратила убыточный BI в доходный продукт с помощью агентного ИИ на Amazon Quick: ускорение запросов в 30 раз и снижение TCO на 40% Разбор кейса Tradeshift: как платформа e-инвойсинга заменила самописный BI на Amazon Quick с агентным ИИ, добилась ускорения запросов в 30 раз, снизила TCO на 4 6 мин чтения