Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

1920 материалов
01 IdleClaw: как создать распределённую сеть инференса AI, используя простаивающие Ollama на ПК сообщества Как использовать простаивающие ПК для создания распределенной сети инференса AI с IdleClaw. Сравнение, установка, примеры использования. Экономьте на API. 5 мин чтения 02 Agent Browser Workspace: установка и настройка локальной альтернативы Perplexity для ИИ-агентов Установите и настройте Agent Browser Workspace — открытый инструмент для браузерных исследований ИИ-агентов без облаков. Экономьте деньги и контролируйте данные 5 мин чтения 03 Qwen3.5-0.8B и 4B: тесты производительности на старом i5, 4 ГБ ОЗУ и iPhone 16 Pro Max Реальные тесты Qwen3.5-0.8B и 4B на процессоре i5 2012 года с 4 ГБ ОЗУ и новом iPhone 16 Pro Max. Скорость, квантование Q4 и сравнение с альтернативами. 6 мин чтения 04 Реверс-инжиниринг Claude Code: как китайские инженеры разобрали кодогенерирующего агента по косточкам Разбор архитектуры Claude Code от shareAI-lab: как устроен цикл агента, динамические навыки и контекстное сжатие. Сравнение с альтернативами. 6 мин чтения 05 Автоматический выбор модели ИИ: как снизить затраты на 70% с помощью локального хука Локальный хук для Cursor и Claude Code автоматически выбирает дешевую модель ИИ под задачу. Экономия до 70% на API-запросах без потери качества. 6 мин чтения 06 LavaSR v2: как улучшить качество аудио в 100 раз быстрее диффузионных моделей на обычном ПК Обзор LavaSR v2 - 50MB модель для bandwidth extension аудио. Обрабатывает 5000 секунд за секунду, превосходит гигантские диффузионные модели. UL-UNAS denoiser, 4 мин чтения 07 Atlas: Rust-движок, который заставляет Qwen3.5-35B летать на GB10 Чистый Rust, кастомные CUDA-ядра для SM121 и NVFP4 квантование. Atlas дает 2.5x прирост против vLLM на DGX Spark. Подробный обзор движка. 4 мин чтения 08 Persistent REPL для локальных LLM: open-source скилл для экономии контекста и долгих сессий агента Open-source скилл с persistent REPL через tmux для локальных LLM. Решает проблему деградации качества на длинном контексте, экономя ресурсы. 5 мин чтения 09 LFM2-24B-A2B: как получить 40 токенов/с на ноутбуке с iGPU Обзор LFM2-24B-A2B — GGUF-модели, которая дает 40 токенов/с на ноутбуке с iGPU. Сравнение с альтернативами, примеры использования и настройки на 04.03.2026. 5 мин чтения 10 SkyDiscover: как использовать open-source фреймворк для открытия алгоритмов с помощью LLM Полный обзор SkyDiscover 2.1 - open-source фреймворка для автоматического открытия алгоритмов через LLM. Установка, примеры, сравнение с AlphaEvolve. 7 мин чтения 11 Qwen3.5-9B-abliterated: как запустить модель с 0% отказов и поддержкой зрения в Ollama Запустите Qwen3.5-9B-abliterated в Ollama: 0% отказов, поддержка изображений, ортогональная проекция и LoRA. Гайд по установке и использованию. 4 мин чтения 12 Обучите diffusion-модель за 24 часа: открытый код и рецепт от Photoroom (PRX Part 3) Полный разбор открытого рецепта и кода от Photoroom для обучения text-to-image моделей за 24 часа на H200 GPU. Примеры, сравнение и для кого это. 5 мин чтения