Тематическая лента
Подборка материалов
Публикации, объединённые общей практической задачей.
4377
материалов
01
Утечка весов ИИ-модели K3: вторая волна слива FP16 и угрозы безопасности
22 июля 2026 года зафиксирована вторая утечка весов K3 в FP16 со встроенной вредоносной нагрузкой. Разбираем отличия от первой волны, механизм кражи GPU-ресурсо
02
Trelis Tiron: open-weight модель для транскрипции и диаризации речи — обзор и практика
Детальный обзор Trelis Tiron — open-weight модели, объединяющей транскрипцию и диаризацию в единой архитектуре. Бенчмарки WER и DER, сравнение с Whisper и PyAnn
03
Рынок B2B-креаторов: как Passionfroot привлёк $15 млн на фоне AI-бума и что это значит для индустрии
Passionfroot закрыл раунд A на $15 млн. Разбираем, как AI-агент Zest и граф создателей обеспечили рост выручки в 13 раз и выплаты креаторам на $10 млн. Сравнени
04
Граф-инжиниринг для AI-агентов: как найти баланс между детерминизмом и гибкостью
Граф-инжиниринг превращает хаотичных AI-агентов в предсказуемые системы. Разбираем, как LangGraph с 65 млн скачиваний в месяц задает жесткие сценарии и оставляе
05
Почему две RTX 5060 Ti не дают 100% загрузки при инференсе LLM: разбор memory-bound архитектуры и сплитинга
Запустили Qwen 3.6 27B на двух RTX 5060 Ti и получили только 50% утилизации? Разбираем физику memory-bound архитектуры, расчёты пропускной способности и два под
06
Guardrails Filter: как защитить данные при работе с LLM с помощью обратного прокси
Пошаговое руководство по внедрению Guardrails Filter от Cloud.ru: архитектура обратного прокси, 260 правил маскировки ПДн, развертывание через Docker и Envoy, G
07
Gemini Intelligence на Samsung Galaxy Z Fold8 и Flip8: автоматизация, исследования и носимые устройства
Gemini Intelligence на Galaxy Z Fold8 и Flip8 автоматизирует задачи в 40+ приложениях, синтезирует контент в Notebook и расширяется на Watch 9 и смарт-очки. Раз
08
Незаменимость разработчика в эпоху AI: управление рисками и инженерные решения
AI не заменит разработчиков: генерация кода — лишь 20% работы. Разбираем реальные риски внедрения AI-генерации, скрытые расходы (от $10 000 до $500 000 за агент
09
Google вложил $40 млн в AI-токены для Genesis Mission: как это ускорит научные открытия
Google выделил $40 млн в виде AI-токенов и облачных кредитов на программу Genesis Mission. Разбираем, какие инструменты DeepMind и Gemini получат лаборатории СШ
10
Looped Transformer: как Nanbeige4.2-3B обходит модели в 4 раза больше за счёт переиспользования слоёв
3B-модель Nanbeige4.2-3B обходит аналоги в 4 раза больше благодаря Looped Transformer. Разбираем архитектуру циклического переиспользования слоёв, результаты бе
11
Санкции против китайских AI-моделей: эскалация технологической войны США
Министр финансов США Скотт Бессент допустил санкции против китайских открытых AI-моделей. Разбираем суть заявления, технику дистилляции, реальные причины успеха
12
SenseNova-U1-8B-MoT-Infographic-V3: точечное редактирование изображений без перегенерации — четыре режима и рост метрик
SenseNova-U1-8B-MoT-Infographic-V3: 8B-модель с четырьмя режимами редактирования изображений без перегенерации. Локальная правка текста и объектов, глобальная с