Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

2253 материалов
01 Google TPU 8i и 8t: чипы, которые заставят AI-агентов работать, а не мечтать Google представила TPU 8i для инференса агентных систем и TPU 8t для обучения. 121 экзафлопс, двойная пропускная способность. Как это изменит рынок AI-железа? 1 мин чтения 02 97% агентов проваливают цепочки: что вскрыл бенчмарк VAKRA в 2026 году VAKRA 2.1 показал: модели теряют контекст на 3 шагах. Разбор ошибок GPT-5, Claude 4.5, Gemini Ultra 2.0 и причины провалов. 4 мин чтения 03 Проблема PR от AI-агентов в open source: как не превратить вклад в хаос AI-агенты заполонили open source бесполезными пул-реквестами. Разбираемся, как отличить ценный вклад от хаоса и не сломать проекты. Советы для контрибьюторов и 3 мин чтения 04 5 лет AlphaFold: как DeepMind меняет медицину и сельское хозяйство – от расшифровки белка 'плохого холестерина' до устойчивых культур AlphaFold исполняется 5 лет: как ИИ DeepMind расшифровал белок apoB100, ускорил создание лекарств от атеросклероза и помог вывести жароустойчивые культуры. Личн 4 мин чтения 05 Mythos Preview, GPT-5.4 и Opus 4.6: кто выиграл в кибербезопасности? Кровь, пот и CTF-флаги Независимое тестирование AISI: результаты CTF-задач. Mythos Preview находит баги за минуты, GPT-5.4 пишет эксплойты, Opus 4.6 выигрывает в анализе. Кто лидер? 1 мин чтения 06 QIMMA: Лидерборд, который валидирует бенчмарки арабских LLM — почему старые рейтинги больше не работают Разбираем QIMMA — лидерборд с проверкой бенчмарков для арабских языковых моделей. Почему старые тесты врут и как новая методология меняет оценку LLM. 4 мин чтения 07 Tokenmaxxing: почему измерение AI-продуктивности по токенам — это новый 'план по гвоздям' Утечка Meta, советские гвозди и Claudeonomics: почему токенмаксинг убивает качество AI и превращает каждую модель в болтливого бюрократа. 4 мин чтения 08 Grok как факт-чекер: почему платить $8 опасно (история с Эрдоганом и скандалы) Илон Маск сделал Grok платным. Но стоит ли $8 факт-чекер, который галлюцинирует и провоцирует международные скандалы? Разбор истории с Эрдоганом и рисков подпис 3 мин чтения 09 GPT-5.4 Pro: миллион токенов и право на ошибку — OpenAI переписывает правила игры OpenAI запустила GPT-5.4 Pro с 1M контекстом, коррекцией в процессе ответа и нативным управлением компьютером. Снижение галлюцинаций на 26.8%, 83% GPT-VAL. Как 5 мин чтения 10 Claude Mythos Preview: как AI находит уязвимости и что это значит для кибербезопасности Anthropic выпустила Claude Mythos Preview — модель, автономно находящую уязвимости. Разбираем, как это изменит кибербезопасность. 4 мин чтения 11 От Edge до Яндекс Браузера: как сплит-вью с ИИ меняет интерфейсы приложений (15 примеров) Разбор тренда split-view с AI: от Edge и Chrome до Яндекс Браузера и Figma. Как боковая панель с ИИ убивает переключение контекста и меняет UX. 4 мин чтения 12 AI-агенты против AI-агентов: кто выигрывает в торговле? Разбор эксперимента Anthropic Project Deal Anthropic провела уникальный эксперимент по торговле между AI-агентами: Claude 4 Opus против GPT-5 и Gemini. Кто оказался честнее и прибыльнее? Разбираем резуль 5 мин чтения