Тематическая лента
Подборка материалов
Публикации, объединённые общей практической задачей.
2253
материалов
01
Google TPU 8i и 8t: чипы, которые заставят AI-агентов работать, а не мечтать
Google представила TPU 8i для инференса агентных систем и TPU 8t для обучения. 121 экзафлопс, двойная пропускная способность. Как это изменит рынок AI-железа?
02
97% агентов проваливают цепочки: что вскрыл бенчмарк VAKRA в 2026 году
VAKRA 2.1 показал: модели теряют контекст на 3 шагах. Разбор ошибок GPT-5, Claude 4.5, Gemini Ultra 2.0 и причины провалов.
03
Проблема PR от AI-агентов в open source: как не превратить вклад в хаос
AI-агенты заполонили open source бесполезными пул-реквестами. Разбираемся, как отличить ценный вклад от хаоса и не сломать проекты. Советы для контрибьюторов и
04
5 лет AlphaFold: как DeepMind меняет медицину и сельское хозяйство – от расшифровки белка 'плохого холестерина' до устойчивых культур
AlphaFold исполняется 5 лет: как ИИ DeepMind расшифровал белок apoB100, ускорил создание лекарств от атеросклероза и помог вывести жароустойчивые культуры. Личн
05
Mythos Preview, GPT-5.4 и Opus 4.6: кто выиграл в кибербезопасности? Кровь, пот и CTF-флаги
Независимое тестирование AISI: результаты CTF-задач. Mythos Preview находит баги за минуты, GPT-5.4 пишет эксплойты, Opus 4.6 выигрывает в анализе. Кто лидер?
06
QIMMA: Лидерборд, который валидирует бенчмарки арабских LLM — почему старые рейтинги больше не работают
Разбираем QIMMA — лидерборд с проверкой бенчмарков для арабских языковых моделей. Почему старые тесты врут и как новая методология меняет оценку LLM.
07
Tokenmaxxing: почему измерение AI-продуктивности по токенам — это новый 'план по гвоздям'
Утечка Meta, советские гвозди и Claudeonomics: почему токенмаксинг убивает качество AI и превращает каждую модель в болтливого бюрократа.
08
Grok как факт-чекер: почему платить $8 опасно (история с Эрдоганом и скандалы)
Илон Маск сделал Grok платным. Но стоит ли $8 факт-чекер, который галлюцинирует и провоцирует международные скандалы? Разбор истории с Эрдоганом и рисков подпис
09
GPT-5.4 Pro: миллион токенов и право на ошибку — OpenAI переписывает правила игры
OpenAI запустила GPT-5.4 Pro с 1M контекстом, коррекцией в процессе ответа и нативным управлением компьютером. Снижение галлюцинаций на 26.8%, 83% GPT-VAL. Как
10
Claude Mythos Preview: как AI находит уязвимости и что это значит для кибербезопасности
Anthropic выпустила Claude Mythos Preview — модель, автономно находящую уязвимости. Разбираем, как это изменит кибербезопасность.
11
От Edge до Яндекс Браузера: как сплит-вью с ИИ меняет интерфейсы приложений (15 примеров)
Разбор тренда split-view с AI: от Edge и Chrome до Яндекс Браузера и Figma. Как боковая панель с ИИ убивает переключение контекста и меняет UX.
12
AI-агенты против AI-агентов: кто выигрывает в торговле? Разбор эксперимента Anthropic Project Deal
Anthropic провела уникальный эксперимент по торговле между AI-агентами: Claude 4 Opus против GPT-5 и Gemini. Кто оказался честнее и прибыльнее? Разбираем резуль