Тематическая лента
Подборка материалов
Публикации, объединённые общей практической задачей.
4377
материалов
01
Куда пропал Google: Анализ провала в гонке AI-моделей 2026
Google полностью выбыл из топ-15 рейтинга AI-моделей 2026. Факты, цифры и анализ двух гипотез провала: ошибочная ставка на on-device инференс и внутренний кризи
02
Перезапуск X для Android: полный разбор нового приложения на Kotlin и Jetpack Compose
X переписал Android-приложение с нуля на Kotlin и Jetpack Compose. Холодный старт ускорен в 2-3 раза, скроллинг держит 60 FPS даже на бюджетных устройствах, уве
03
Архитектура мультимодельного AI-ассистента Couchbase Capella iQ на базе Amazon Bedrock: кросс-региональный инференс, маршрутизация и точность 76%
Детальный разбор продакшен-архитектуры Capella iQ: как Couchbase построила мультимодельного ассистента на Amazon Bedrock с кросс-региональным инференсом, маршру
04
Открытые модели ИИ: почему Kimi K3 и другие угрожают OpenAI и как регулирование изменит рынок
Релиз Kimi K3 с 2.8 трлн параметров обрушил Nasdaq и поставил под вопрос бизнес-модели OpenAI и Anthropic. Разбираем, почему открытые модели выигрывают гонку, к
05
Qwen3.6 35B A3B на RX 6600 XT: реальные 300 t/s prefill и разгром официальных бенчмарков
Пользовательский тест Qwen3.6 35B A3B на RX 6600 XT показал 300 t/s prefill и 30 t/s decode — в 10 раз выше официальных бенчмарков. Разбираем настройку llama.cp
06
Интеграция локальных LLM в мультимедийные пайплайны: новый GStreamer-плагин на базе llama.cpp
GStreamer-плагин на llama.cpp выполняет перевод текста прямо в медиапайплайне. В связке с Whisper — автоматические субтитры с переводом в реальном времени. Пило
07
MCP становится stateless: как обновление протокола упрощает инфраструктуру AI-агентов
Model Context Protocol переходит на stateless-архитектуру, отказываясь от session ID. Узнайте, как это решит проблему синхронизации сессий, упростит масштабиров
08
NVIDIA Cosmos 3 Edge: архитектура, возможности и производительность компактной модели мира для edge-устройств
NVIDIA Cosmos 3 Edge — открытая модель мира с 4 млрд параметров, работающая в реальном времени на edge-устройствах. Разбираем гибридную архитектуру из двух тран
09
Строим AI-агента с нуля: архитектура, метрики и код на Python
Разбираем архитектуру самописного AI-агента: оркестрация LLM, память, инструменты и обработка ошибок. Практический код на Python с LangChain и LiteLLM, сравнени
10
Ежедневные чекпоинты Qwen3.8: как Alibaba переизобретает итерации и почему Google с Bard 1.0 проиграл в скорости
Alibaba выпускает обновлённые веса Qwen3.8 каждые 24 часа. Разбираем механику ежедневных чекпоинтов, прогресс в генерации веб-интерфейсов и сравниваем с провало
11
Рой ИИ-агентов за $1339: как Cursor воссоздал SQLite на Rust и чему нас учит этот эксперимент
Рой ИИ-агентов Cursor воссоздал SQLite на Rust за $1339. Разбираем архитектуру с разделением на планировщиков и воркеров, механизмы синхронизации через дизайн-д
12
Почему проприетарные AI-модели США уступают открытым альтернативам: анализ тренда
LLaMA 3.1, DeepSeek V3 и Mixtral сравнялись с GPT-4o и Claude в ключевых бенчмарках. Разбираем цифры, причины сдвига и практические выводы для бизнеса: как сэко