Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

1920 материалов
01 FCE: как ускорить RAG для анализа кода до 50 наносекунд на запрос Обзор FCE: in-memory граф символов ускоряет RAG для анализа кода. Бенчмарки на Unreal Engine, поддержка 10 языков через tree-sitter, Python bindings. 5 мин чтения 02 Собираем синхронного переводчика на коленке: Whisper v4, NLLB-200 и CUDA 13 в реальном времени на Windows Полный гайд по сборке локального переводчика речи в реальном времени на Windows. Настройка Whisper v4, NLLB-200 и CUDA 13 без облаков и с задержкой <2 секунд. 6 мин чтения 03 VLM Prompt Lab: панель для тестирования vision-моделей в FiftyOne (установка через pip) Обзор VLM Prompt Lab в FiftyOne. Как установить через pip, тестировать vision-модели и промпты в 2026 году. Сравнение с альтернативами и примеры использования. 5 мин чтения 04 Автономные исследования ИИ: Karpathy autoresearch и как заставить ИИ учиться самому Как использовать Karpathy autoresearch для самообучения моделей. Возможности, сравнение с аналогами, примеры использования и рекомендации. 5 мин чтения 05 Как создать игрового бота в Minecraft с локальной LLM Nemotron 9B: разбор архитектуры на vLLM и Mineflayer Пошаговый гайд по созданию умного Minecraft бота с локальной LLM Nemotron 9B. Используем vLLM для инференса и Mineflayer для взаимодействия с игрой. 6 мин чтения 06 Kokoro TTS на Android: строим полностью офлайн-приложение для аудиокниг из EPUB Как использовать Kokoro TTS на Android для конвертации EPUB в аудиокниги без интернета. Сравнение с Pocket TTS, XTTS, требования к железу и секреты производител 6 мин чтения 07 Архитектура Vera 1.6: как Gated Delta Networks и Sparse MoE создают агента с 1M контекстом Глубокий разбор Vera 1.6: Gated Delta Networks, Sparse Mixture-of-Experts и RoPE scaling для агентов с контекстом в миллион токенов. Сравнение, примеры, для ког 6 мин чтения 08 Disco-Torch: как портировать DeepMind DiscoRL из JAX в PyTorch с помощью Claude Code Обзор Disco-Torch — инструмента для автоматического переноса алгоритма DeepMind DiscoRL из JAX в PyTorch с использованием Claude Code. Актуально на 2026 год. 5 мин чтения 09 Запуск TripoSR на iPhone: полное руководство по ONNX Runtime и CoreML для 3D-реконструкции Пошаговый гайд по запуску TripoSR для 3D-реконструкции на iPhone с использованием ONNX Runtime и CoreML. Локальный AI без облаков. 7 мин чтения 10 Tesla P40 против vLLM: как взломать фреймворк для работы с устаревшей архитектурой Практический гайд по модификации vLLM 0.5.8 для работы с GPU Tesla P40 (архитектура Pascal) и запуска модели Qwen3 ASR для транскрипции аудио в 2026 году. 5 мин чтения 11 Triton2CUDA: конвертер ядер из Triton API в CUDA C++ для ускорения ML-разработки Обзор Triton2CUDA - инструмента для конвертации ядер из Triton API в CUDA C++. Возможности, сравнение с альтернативами, примеры использования. Актуально на март 5 мин чтения 12 Как запустить NVFP4 MoE модели на RTX 5090/Pro 6000 (Blackwell): фикс сломанных ядер через --moe-backend marlin в vLLM Подробный гайд по запуску больших MoE-моделей (Qwen3.5 397B) в NVFP4 на Blackwell (SM120) через vLLM с флагом --moe-backend marlin. Решение проблемы генерации м 5 мин чтения