Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

1920 материалов
01 Unsloth Dynamic 2.0: Как умное выборочное квантование GGUF ускоряет инференс и экономит память Unsloth Dynamic 2.0 ускоряет инференс и экономит память с помощью выборочного квантования слоев. Сравнение, примеры использования и рекомендации. 6 мин чтения 02 Speechos: ваш личный полигон для речевых моделей, который не шпионит за вами Speechos: open-source инструмент для локального бенчмаркинга речевых моделей. Сравнивайте Whisper, Vosk, Supertonic 2 TTS без облаков. Адаптация к железу. 5 мин чтения 03 Conda-пакеты для AI-моделей: версионирование, кэширование и безопасность с rattler-build Как rattler-build решает проблемы версионирования, кэширования и безопасности AI-моделей в Conda-пакетах. Пример упаковки whisper.cpp. 6 мин чтения 04 TranslateGemma UI: Веб-интерфейс для локального перевода, который не стыдно показать коллегам Разверните свой приватный переводчик с веб-интерфейсом за 5 минут. Gemma 3, Docker, Ollama — и никаких облачных API. Полный гайд на февраль 2026 года. 6 мин чтения 05 DeepSeek DeepGEMM: как обновление с mHC и поддержкой Blackwell ускорит работу LLM Технический обзор DeepSeek DeepGEMM: как обновление с Manifold-constrained Hyper-connections и поддержкой NVIDIA Blackwell ускоряет матричные вычисления для LLM 5 мин чтения 06 LLmFit: как одной командой подобрать идеальную LLM-модель под ваше железо Обзор LLmFit - инструмента для подбора LLM-моделей под аппаратное обеспечение. Узнайте, как одной командой найти идеальную модель для вашего GPU и RAM. 5 мин чтения 07 Как запустить гигантские MoE-модели на одной видеокарте: разбор гибридного рантайма Krasis и бенчмарки Гибридный рантайм Krasis позволяет запускать гигантские MoE-модели на одной видеокарте. Бенчмарки скорости префилла на RTX 5080 и других GPU. 5 мин чтения 08 Полное руководство по квантованию Qwen3.5-35B-A3B: разбор SOTA GGUFs от Unsloth и лучшие практики Разбор динамических GGUF от Unsloth для Qwen3.5-35B-A3B: KL Divergence, чувствительные тензоры, сравнение методов квантования и рекомендации по выбору. 3 мин чтения 09 PageAgent: браузерный AI-агент для локального запуска с Ollama — обзор и туториал PageAgent - браузерный AI-агент, работающий локально с Ollama. DOM как текст, автоматизация без облачных API. Полный обзор, сравнение и туториал. 6 мин чтения 10 Qwen 3.5 122B A10B: разбор рекорда в UGI, запуск с UD Q2KXL и обход цензуры Обзор Qwen 3.5 122B A10B: рекорд в бенчмарке UGI, сравнение с GPT OSS 120B, запуск с квантованием UD Q2KXL и методы обхода цензуры в reasoning. 6 мин чтения 11 AutoBe: как слабые локальные LLM отладили генератор backend-приложений до 100% успеха Как инструмент AutoBe использует слабые локальные LLM для отладки и достигает 100% успеха в генерации backend-приложений на NestJS и Prisma. 5 мин чтения 12 Perplexity Computer: как работает супер-агент, который управляет другими ИИ (Claude, Gemini, GPT-5.2) Как Perplexity Computer оркестрирует Claude Opus 4.6, GPT-5.2 и Gemini для сложных задач. Возможности, сравнение с аналогами и кому подойдет. 7 мин чтения