Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

1920 материалов
01 MLX 26.2 и RDMA: как распределённые вычисления на Mac с Thunderbolt 5 ускоряют запуск LLM Обзор MLX 26.2 с RDMA для распределённых вычислений на Mac через Thunderbolt 5. Как снизить TTFT для локальных моделей в 3 раза. Тесты MoE-архитектур. 8 мин чтения 02 Mutsu Studio Lite: когда чат с ИИ превращается в визуальную новеллу на вашем компьютере Настройка Mutsu Studio Lite для приватных ролевых игр с ИИ в стиле Visual Novel. Live2D модели, Emotional Damping, системные промпты - полный гайд на 2026 год. 7 мин чтения 03 Agentic Debugging: как заставить LLM искать баги в C/C++ коде с помощью OpenCode и term-cli Пошаговый гайд по использованию OpenCode и term-cli для автоматической отладки багов в нативном коде на примере ffmpeg/x264. Сравнение с альтернативами и практи 7 мин чтения 04 GAE (Geodesic Attention Engine): как запустить точное внимание для 1M токенов на 1 ГБ VRAM Geodesic Attention Engine сокращает использование памяти на 99.6% для длинных контекстов. Узнайте, как запустить 1 млн токенов на 1 ГБ VRAM. 6 мин чтения 05 Minimax m2.1 DWQ MLX: почему эта квантованная модель стала скрытым алмазом для Mac и исследовательской работы Обзор Minimax m2.1 DWQ MLX — квантованной 4-bit модели для MLX на Mac. Сравнение с альтернативами, параметры запуска, примеры использования для владельцев M2 Ul 5 мин чтения 06 Эксперимент Anthropic: как 16 AI-агентов Claude создали компилятор C с нуля Технический разбор эксперимента Anthropic: 16 автономных агентов Claude Opus 4.6 создали работающий компилятор C. Docker, Git, Rust и реальная стоимость API. 7 мин чтения 07 Serpentine TTS: 90ms задержки и 3.5GB памяти — локальный синтез речи для Mac, который не просит денег Обзор Serpentine TTS — локального TTS для Mac с задержкой 90ms, архитектурой look-ahead и поддержкой MLX. Сравнение с Elevenlabs, установка и примеры. 6 мин чтения 08 Голосовой агент с RAG на GTX 1650: как уложиться в 400 мс при 4 ГБ VRAM Пошаговый гайд по созданию голосового агента с иерархическим RAG на GTX 1650 (4 ГБ VRAM). Код, оптимизации Zero-Copy Memory, задержка менее 400 мс. 10 мин чтения 09 MacBook превращается в стенографиста: как собрать полностью локальный рекордер встреч с Whisper и Llama Полное руководство по созданию приватного рекордера встреч для Mac на базе Whisper и Llama. Аудио не покидает устройство, полный контроль над данными. 7 мин чтения 10 Structured Outputs в Amazon Bedrock: как создать валидные JSON-ответы без ручной проверки Как использовать Structured Outputs в Amazon Bedrock для получения валидных JSON-ответов от LLM без ручной валидации. Примеры и сравнение с альтернативами. 5 мин чтения 11 PersonaPod: ваш личный подкаст-франкенштейн, который говорит вашим голосом Создайте персонализированный подкаст из RSS-лент с вашим клонированным голосом. PersonaPod на llama.cpp и MaskGCT TTS - установка, настройка, примеры. 5 мин чтения 12 Superlinear: практический гайд по запуску модели с субквадратичным вниманием для контекста 10M токенов Пошаговое руководство по запуску Superlinear — модели с субквадратичным вниманием O(L^(3/2)) для контекста до 10 миллионов токенов на одном GPU. 8 мин чтения