Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

1920 материалов
01 AgentCrawl: Как создать оптимизированный под LLM скрапер с автоматическим переходом на headless-браузер AgentCrawl - библиотека для гибридного веб-скрапинга под LLM с автоматическим переходом на Playwright. Оптимизация токенов, чистый Markdown, интеграция Vercel A 6 мин чтения 02 GLM-4.7 Flash: китайский снайпер против Qwen 32B GLM-4.7 Flash бенчмарки, сравнение производительности с Qwen 32B, скачать модель Zhipu AI. Полная инструкция по запуску и квантованию. 5 мин чтения 03 LlamaBarn 0.23: macOS-приложение, которое само загружает модели и не просит помощи Обзор LlamaBarn 0.23 - macOS-приложения для локальных LLM с автоматической загрузкой моделей, Router Mode и оптимизацией памяти. Установка через Homebrew. 7 мин чтения 04 Ghost Engine: как запустить Llama-3-8B на 3 ГБ VRAM и не сойти с ума Революционный метод сжатия LLM через архитектуру Predator-Prey. Запускаем Llama-3-8B на 3 ГБ видеопамяти — полный обзор технологии. 5 мин чтения 05 Claude Cowork: полный обзор агентского режима Anthropic на macOS — возможности, интеграции и реальные недостатки Разбираем Claude Cowork — агентский режим Anthropic для macOS. Как работает изолированная Linux VM, интеграции MCP, подписка Claude Max. Реальные проблемы с про 6 мин чтения 06 On-device браузерный агент на Qwen: локальный Chrome без облаков Как установить и использовать браузерный AI-агент на Qwen для автоматизации задач прямо в Chrome без интернета. On-device решение для приватности. 5 мин чтения 07 Оптимизированный Top-K для LLM: ускорение инференса в 20 раз на CPU с AVX2 Как оптимизированный Top-K с AVX2 ускоряет выборку токенов в llama.cpp до 20 раз на обычных процессорах. Бенчмарки, интеграция, сравнение с альтернативами. 4 мин чтения 08 WallPlan: как нейросети генерируют планировки через графы стен, а не пиксели Технический разбор WallPlan - нейросети, которая генерирует архитектурные планировки через графы стен, а не пиксели. Три CNN: WinNet, GraphNet, LabelNet. 5 мин чтения 09 Iris Agent: фреймворк, где вы видите каждую шестерёнку Обзор минималистичного Iris Agent - open-source фреймворка для создания и обучения AI-агентов с полной прозрачностью архитектуры. 5 мин чтения 10 FLUX.2 Klein на стероидах: заставляем 9B-модель летать быстрее мысли на A100 Готовые скрипты Gradio и FastAPI для FLUX.2 Klein с оптимизациями torch.compile и fused QKV. Запуск за 0.9 секунды на A100. 5 мин чтения 11 SEDAC v5: обзор фреймворка динамического ускорения LLM на основе семантической энтропии - применение для edge-устройств Обзор фреймворка SEDAC v5 для динамического ускорения инференса языковых моделей на edge-устройствах с помощью семантической энтропии. Сравнение, примеры, реком 5 мин чтения 12 cuda-nn: как запустить MoE-модель на 6.9B параметров без PyTorch на Rust, Go и CUDA Обзор cuda-nn — inference движка на Rust, Go и CUDA для запуска MoE моделей на 6.9B параметров без PyTorch. Сравнение с альтернативами, оптимизация ядер. 5 мин чтения