Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

4377 материалов
01 Куда пропал Google: Анализ провала в гонке AI-моделей 2026 Google полностью выбыл из топ-15 рейтинга AI-моделей 2026. Факты, цифры и анализ двух гипотез провала: ошибочная ставка на on-device инференс и внутренний кризи 8 мин чтения 02 Перезапуск X для Android: полный разбор нового приложения на Kotlin и Jetpack Compose X переписал Android-приложение с нуля на Kotlin и Jetpack Compose. Холодный старт ускорен в 2-3 раза, скроллинг держит 60 FPS даже на бюджетных устройствах, уве 8 мин чтения 03 Архитектура мультимодельного AI-ассистента Couchbase Capella iQ на базе Amazon Bedrock: кросс-региональный инференс, маршрутизация и точность 76% Детальный разбор продакшен-архитектуры Capella iQ: как Couchbase построила мультимодельного ассистента на Amazon Bedrock с кросс-региональным инференсом, маршру 12 мин чтения 04 Открытые модели ИИ: почему Kimi K3 и другие угрожают OpenAI и как регулирование изменит рынок Релиз Kimi K3 с 2.8 трлн параметров обрушил Nasdaq и поставил под вопрос бизнес-модели OpenAI и Anthropic. Разбираем, почему открытые модели выигрывают гонку, к 7 мин чтения 05 Qwen3.6 35B A3B на RX 6600 XT: реальные 300 t/s prefill и разгром официальных бенчмарков Пользовательский тест Qwen3.6 35B A3B на RX 6600 XT показал 300 t/s prefill и 30 t/s decode — в 10 раз выше официальных бенчмарков. Разбираем настройку llama.cp 8 мин чтения 06 Интеграция локальных LLM в мультимедийные пайплайны: новый GStreamer-плагин на базе llama.cpp GStreamer-плагин на llama.cpp выполняет перевод текста прямо в медиапайплайне. В связке с Whisper — автоматические субтитры с переводом в реальном времени. Пило 9 мин чтения 07 MCP становится stateless: как обновление протокола упрощает инфраструктуру AI-агентов Model Context Protocol переходит на stateless-архитектуру, отказываясь от session ID. Узнайте, как это решит проблему синхронизации сессий, упростит масштабиров 4 мин чтения 08 NVIDIA Cosmos 3 Edge: архитектура, возможности и производительность компактной модели мира для edge-устройств NVIDIA Cosmos 3 Edge — открытая модель мира с 4 млрд параметров, работающая в реальном времени на edge-устройствах. Разбираем гибридную архитектуру из двух тран 8 мин чтения 09 Строим AI-агента с нуля: архитектура, метрики и код на Python Разбираем архитектуру самописного AI-агента: оркестрация LLM, память, инструменты и обработка ошибок. Практический код на Python с LangChain и LiteLLM, сравнени 10 мин чтения 10 Ежедневные чекпоинты Qwen3.8: как Alibaba переизобретает итерации и почему Google с Bard 1.0 проиграл в скорости Alibaba выпускает обновлённые веса Qwen3.8 каждые 24 часа. Разбираем механику ежедневных чекпоинтов, прогресс в генерации веб-интерфейсов и сравниваем с провало 9 мин чтения 11 Рой ИИ-агентов за $1339: как Cursor воссоздал SQLite на Rust и чему нас учит этот эксперимент Рой ИИ-агентов Cursor воссоздал SQLite на Rust за $1339. Разбираем архитектуру с разделением на планировщиков и воркеров, механизмы синхронизации через дизайн-д 7 мин чтения 12 Почему проприетарные AI-модели США уступают открытым альтернативам: анализ тренда LLaMA 3.1, DeepSeek V3 и Mixtral сравнялись с GPT-4o и Claude в ключевых бенчмарках. Разбираем цифры, причины сдвига и практические выводы для бизнеса: как сэко 9 мин чтения