Тематическая лента
Подборка материалов
Публикации, объединённые общей практической задачей.
1920
материалов
01
Chatterbox Turbo на VLLM: как добиться 37.6x ускорения генерации речи на RTX 4090
Портирование TTS-модели Chatterbox Turbo на vLLM дает ускорение в 37.6 раз на RTX 4090. Бенчмарки, настройка и примеры для реального синтеза речи.
02
MCP memory server на Rust: когда граф знаний встречает нейроны в хранилище
Гибридный поиск на Rust, граф знаний и нейропластичность памяти для AI агентов. Сравнение с Python, тесты производительности и примеры использования.
03
MuninnDB: как настроить Dream Engine для консолидации памяти LLM с изоляцией данных Ollama
Полное руководство по настройке MuninnDB Dream Engine для консолидации памяти LLM с изоляцией данных через Ollama vault. Актуально на 2026 год.
04
TideSurf: как сжать DOM в 30 раз для веб-агентов и ускорить TTFT в 12 раз на Qwen 3.5 9B (туториал по npm-пакету)
TideSurf сокращает токены DOM на 30x и ускоряет время до первого токена в 12 раз для веб-агентов на Qwen 3.5 9B. Гайд по установке и использованию npm @tidesurf
05
Как запустить LLM на портативной консоли: SpruceChat для Miyoo и Trimui
Пошаговая инструкция по установке SpruceChat и запуску локального ИИ на портативных консолях Miyoo A30 и Trimui Smart Pro в 2026 году.
06
Cohere Transcribe в браузере: Нужен ли вам 2B-монстр, если у вас есть WebGPU и смелость?
Обзор демо Cohere Transcribe, работающего локально в браузере через WebGPU. Сравнение с альтернативами, примеры использования и рекомендации.
07
Vera: локальный поиск кода для AI агентов — установка, настройка и сравнение с аналогами
Обзор Vera — инструмента для локального поиска кода на Rust. Сравнение с аналогами, установка, настройка и примеры использования для AI агентов.
08
Плагины OpenAI Codex 2026: От игрушки к серьезному оружию. Установка за 1 клик и интеграция с GitHub и Gmail
Новые плагины и MCP серверы для OpenAI Codex в 2026. Как установить и использовать для работы с GitHub и Gmail. Сравнение с Claude Code и другими альтернативами
09
LCME: память для LLM, которая работает быстрее, чем вы успеваете моргнуть
Обзор LCME - memory engine для локальных LLM с скоростью до 430x быстрее Mem0. Установка, сравнение с альтернативами, примеры использования.
10
Unsloth Studio Beta: инференс быстрее на 30%, тул-коллинг и бинарники llama.cpp из коробки
Обзор Unsloth Studio Beta: ускорение инференса LLM на 30%, тул-коллинг, предустановленные бинарники llama.cpp. Установка, сравнение, примеры использования. Акту
11
MinerU-Diffusion: как диффузионный OCR ускоряет парсинг PDF в 3 раза (код на GitHub, поддержка MLX)
Обзор MinerU-Diffusion на 27.03.2026: как диффузионный декодирование и поддержка MLX ускоряют OCR для парсинга PDF-файлов. Сравнение с Tesseract, EasyOCR, инстр
12
MemAware: почему память RAG-агентов проваливается на неявном контексте и как это тестировать
Открытый бенчмарк MemAware вскрывает главную слабость RAG-систем: неспособность работать с неявным контекстом. Примеры, сравнения и как тестировать свои агенты.