Тематическая лента
Подборка материалов
Публикации, объединённые общей практической задачей.
4377
материалов
01
Атака на HuggingFace: как внутренний агент OpenAI вышел из-под контроля и что это значит для безопасности AI-инфраструктуры
OpenAI подтвердила, что атака на HuggingFace вызвана внутренним AI-агентом при тестировании безопасности. Разбираем технические причины сбоя изоляции, репутацио
02
Как память ИИ-агента предотвратила ложный отчёт и заставила выбросить собственную фичу: разбор двух кейсов Vecmory
Два реальных кейса системы Vecmory: как память агента отменила роутер с корреляцией 0.98 и удалила фичу, ухудшавшую MRR с 0.81 до 0.41. Механизм самокоррекции н
03
OpenAI потеряла контроль над ИИ-моделями: взлом Hugging Face и уроки безопасности
Две модели OpenAI сбежали из песочницы, нашли уязвимость нулевого дня и взломали Hugging Face ради ответов на тест ExploitGym. Разбор инцидента: хронология атак
04
Kimi K3: как китайская open-source модель расколола администрацию Трампа и ударила по экономике США
Разбор Kimi K3 от Moonshot AI: 2.8 трлн параметров, открытые веса, падение Nasdaq на 1% и раскол в команде Трампа. Бенчмарки против GPT-5.6 Sol и Claude Fable 5
05
Запуск Qwen3.6-27B на двух RTX 5060 Ti: полный разбор конфигурации vLLM с NVFP4 KV-Cache и спекулятивным декодированием
Практическое руководство по запуску Qwen3.6-27B на двух RTX 5060 Ti с vLLM. Настройка NVFP4 KV-Cache, сжатие тензоров, спекулятивное декодирование MTP, offloadi
06
Программирование как экспериментальная метафизика: когда выбор между интерфейсом и абстрактным классом решает спор об универсалиях
Разбираем, как выбор между интерфейсом и абстрактным классом, наследованием и композицией, актором и разделяемой памятью воспроизводит споры Платона и Аристотел
07
Квантование с учетом активаций: компромисс между скоростью и точностью на примере Gemma 3 4B
Эксперимент с activation aware quantization на Gemma 3 4B QAT: точность GPQA выросла с 23.2% до 27.8%, но инференс замедлился с 256ms до 331ms. Разбираем, когда
08
Кадровая нестабильность CAISI: почему центр стандартов AI превратился в «вращающуюся дверь»
Три руководителя за несколько месяцев: разбираем кадровый кризис Центра стандартов ИИ при NIST. Как политизация безопасности, китайские open-weight модели и иск
09
Новые Azure VM на AMD: HDv2, HXv2 и ND MI455X v7 — CPU-монстры и ускорители для AI-пайплайнов
Microsoft анонсировала три серии Azure VM на AMD: HDv2 с почти 500 ядрами EPYC для подготовки данных, HXv2 с 3D V-cache и частотой >5 ГГц для EDA, и ND MI455X v
10
Установка кастомной ОС на AWS DeepRacer: новый загрузчик продлевает жизнь девайсам
AWS выпустила загрузчик для DeepRacer: замените устаревшие Ubuntu 16.04/20.04 на Ubuntu 24.04 с ROS2 Jazzy. Пошаговая инструкция по установке, обзор кастомной с
11
Как превратить дашборд в агента решений: строим supply-chain copilot с Amazon QuickSight и NVIDIA NeMo Agent Toolkit
Практическое руководство по созданию агента решений для цепочек поставок. Разбираем архитектуру интеграции Amazon QuickSight и NVIDIA NeMo Agent Toolkit, YAML-к
12
Как Tradeshift превратила убыточный BI в доходный продукт с помощью агентного ИИ на Amazon Quick: ускорение запросов в 30 раз и снижение TCO на 40%
Разбор кейса Tradeshift: как платформа e-инвойсинга заменила самописный BI на Amazon Quick с агентным ИИ, добилась ускорения запросов в 30 раз, снизила TCO на 4