Тематическая лента
Подборка материалов
Публикации, объединённые общей практической задачей.
1920
материалов
01
AgentCrawl: Как создать оптимизированный под LLM скрапер с автоматическим переходом на headless-браузер
AgentCrawl - библиотека для гибридного веб-скрапинга под LLM с автоматическим переходом на Playwright. Оптимизация токенов, чистый Markdown, интеграция Vercel A
02
GLM-4.7 Flash: китайский снайпер против Qwen 32B
GLM-4.7 Flash бенчмарки, сравнение производительности с Qwen 32B, скачать модель Zhipu AI. Полная инструкция по запуску и квантованию.
03
LlamaBarn 0.23: macOS-приложение, которое само загружает модели и не просит помощи
Обзор LlamaBarn 0.23 - macOS-приложения для локальных LLM с автоматической загрузкой моделей, Router Mode и оптимизацией памяти. Установка через Homebrew.
04
Ghost Engine: как запустить Llama-3-8B на 3 ГБ VRAM и не сойти с ума
Революционный метод сжатия LLM через архитектуру Predator-Prey. Запускаем Llama-3-8B на 3 ГБ видеопамяти — полный обзор технологии.
05
Claude Cowork: полный обзор агентского режима Anthropic на macOS — возможности, интеграции и реальные недостатки
Разбираем Claude Cowork — агентский режим Anthropic для macOS. Как работает изолированная Linux VM, интеграции MCP, подписка Claude Max. Реальные проблемы с про
06
On-device браузерный агент на Qwen: локальный Chrome без облаков
Как установить и использовать браузерный AI-агент на Qwen для автоматизации задач прямо в Chrome без интернета. On-device решение для приватности.
07
Оптимизированный Top-K для LLM: ускорение инференса в 20 раз на CPU с AVX2
Как оптимизированный Top-K с AVX2 ускоряет выборку токенов в llama.cpp до 20 раз на обычных процессорах. Бенчмарки, интеграция, сравнение с альтернативами.
08
WallPlan: как нейросети генерируют планировки через графы стен, а не пиксели
Технический разбор WallPlan - нейросети, которая генерирует архитектурные планировки через графы стен, а не пиксели. Три CNN: WinNet, GraphNet, LabelNet.
09
Iris Agent: фреймворк, где вы видите каждую шестерёнку
Обзор минималистичного Iris Agent - open-source фреймворка для создания и обучения AI-агентов с полной прозрачностью архитектуры.
10
FLUX.2 Klein на стероидах: заставляем 9B-модель летать быстрее мысли на A100
Готовые скрипты Gradio и FastAPI для FLUX.2 Klein с оптимизациями torch.compile и fused QKV. Запуск за 0.9 секунды на A100.
11
SEDAC v5: обзор фреймворка динамического ускорения LLM на основе семантической энтропии - применение для edge-устройств
Обзор фреймворка SEDAC v5 для динамического ускорения инференса языковых моделей на edge-устройствах с помощью семантической энтропии. Сравнение, примеры, реком
12
cuda-nn: как запустить MoE-модель на 6.9B параметров без PyTorch на Rust, Go и CUDA
Обзор cuda-nn — inference движка на Rust, Go и CUDA для запуска MoE моделей на 6.9B параметров без PyTorch. Сравнение с альтернативами, оптимизация ядер.