Тематическая лента
Подборка материалов
Публикации, объединённые общей практической задачей.
1920
материалов
01
IdleClaw: как создать распределённую сеть инференса AI, используя простаивающие Ollama на ПК сообщества
Как использовать простаивающие ПК для создания распределенной сети инференса AI с IdleClaw. Сравнение, установка, примеры использования. Экономьте на API.
02
Agent Browser Workspace: установка и настройка локальной альтернативы Perplexity для ИИ-агентов
Установите и настройте Agent Browser Workspace — открытый инструмент для браузерных исследований ИИ-агентов без облаков. Экономьте деньги и контролируйте данные
03
Qwen3.5-0.8B и 4B: тесты производительности на старом i5, 4 ГБ ОЗУ и iPhone 16 Pro Max
Реальные тесты Qwen3.5-0.8B и 4B на процессоре i5 2012 года с 4 ГБ ОЗУ и новом iPhone 16 Pro Max. Скорость, квантование Q4 и сравнение с альтернативами.
04
Реверс-инжиниринг Claude Code: как китайские инженеры разобрали кодогенерирующего агента по косточкам
Разбор архитектуры Claude Code от shareAI-lab: как устроен цикл агента, динамические навыки и контекстное сжатие. Сравнение с альтернативами.
05
Автоматический выбор модели ИИ: как снизить затраты на 70% с помощью локального хука
Локальный хук для Cursor и Claude Code автоматически выбирает дешевую модель ИИ под задачу. Экономия до 70% на API-запросах без потери качества.
06
LavaSR v2: как улучшить качество аудио в 100 раз быстрее диффузионных моделей на обычном ПК
Обзор LavaSR v2 - 50MB модель для bandwidth extension аудио. Обрабатывает 5000 секунд за секунду, превосходит гигантские диффузионные модели. UL-UNAS denoiser,
07
Atlas: Rust-движок, который заставляет Qwen3.5-35B летать на GB10
Чистый Rust, кастомные CUDA-ядра для SM121 и NVFP4 квантование. Atlas дает 2.5x прирост против vLLM на DGX Spark. Подробный обзор движка.
08
Persistent REPL для локальных LLM: open-source скилл для экономии контекста и долгих сессий агента
Open-source скилл с persistent REPL через tmux для локальных LLM. Решает проблему деградации качества на длинном контексте, экономя ресурсы.
09
LFM2-24B-A2B: как получить 40 токенов/с на ноутбуке с iGPU
Обзор LFM2-24B-A2B — GGUF-модели, которая дает 40 токенов/с на ноутбуке с iGPU. Сравнение с альтернативами, примеры использования и настройки на 04.03.2026.
10
SkyDiscover: как использовать open-source фреймворк для открытия алгоритмов с помощью LLM
Полный обзор SkyDiscover 2.1 - open-source фреймворка для автоматического открытия алгоритмов через LLM. Установка, примеры, сравнение с AlphaEvolve.
11
Qwen3.5-9B-abliterated: как запустить модель с 0% отказов и поддержкой зрения в Ollama
Запустите Qwen3.5-9B-abliterated в Ollama: 0% отказов, поддержка изображений, ортогональная проекция и LoRA. Гайд по установке и использованию.
12
Обучите diffusion-модель за 24 часа: открытый код и рецепт от Photoroom (PRX Part 3)
Полный разбор открытого рецепта и кода от Photoroom для обучения text-to-image моделей за 24 часа на H200 GPU. Примеры, сравнение и для кого это.