Тематическая лента
Подборка материалов
Публикации, объединённые общей практической задачей.
1920
материалов
01
Собираем AI-агента с Strands и Amazon Bedrock: полный гайд по развертыванию в облаке
Как собрать AI-агента на открытом фреймворке Strands и запустить в облаке через Amazon Bedrock. Примеры кода, сравнение с альтернативами, советы по настройке.
02
Hister: гугл для AI-агента, который не сливает ваши данные в облако
Разбираем Hister — self-hosted поисковик с MCP-эндпоинтом, который даёт локальному AI-ассистенту долговременную память. Сравнение с альтернативами, примеры наст
03
openPangu-2.0-Flash: китайский LLM, который заставит вас пересмотреть понятие «быстро»
Китайская LLM openPangu-2.0-Flash с Flash-архитектурой: обзор возможностей, сравнение с Qwen, GLM-4.7 Flash, MiMo-V2, тесты и кому подойдет. Обновлено 2026.
04
audio.cpp: запускаем VibeVoice 1.5B на C++/ggml в 4 раза быстрее реального времени
Порт VibeVoice 1.5B на C++/ggml даёт 4.08x real-time на RTX 5090 и 2.86x ускорение против Python. Обзор возможностей, бенчмарки и примеры использования.
05
Запуск Agents-A1 GGUF: 35B Qwen3.5-MoE, NVFP4 для Blackwell и MTP speculative decoding с ускорением 1.22x
Вышли GGUF-кванты агентной модели Agents-A1 на базе Qwen3.5-MoE с поддержкой NVFP4 для Blackwell и MTP speculative decoding. Ускорение 1.22x, детали.
06
Claude Sonnet 5: агентный бюджетник, который заставит Opus нервно курить в сторонке
Обзор Claude Sonnet 5 — агентной модели Anthropic с низкой ценой API. Сравнение с Opus 4.8, тесты автономности, цена за токен, кому подойдет.
07
PageStorm: как локальная модель для книг заменяет ChatGPT и не боится тормозов
Полный обзор PageStorm — open-source LLM для писателей. Локальный запуск, генерация глав, контроль сюжета. Сравнение с Claude и Llama, реальные примеры промптов
08
TurboOCR v3: как запустить высокоскоростной сервер OCR на C++/CUDA (до 520 img/с на RTX 5090)
Обзор TurboOCR v3 — высокоскоростного OCR сервера на C++/CUDA с моделью PP-OCRv6 tiny. Разбор архитектуры, бенчмарки RTX 5090, сравнение с PaddleOCR и DharmaOCR
09
Как стандартизировать отчеты об оценках ИИ: разбираем JSON-схему EEE от Hugging Face
Разбираем JSON-схему EEE для унификации метрик моделей. Сравнение с альтернативами, примеры использования, кому подойдет инструмент.
10
Norm-preserving abliteration на Qwen3.6-35B: как снять цензуру без потери качества (датасет открыт)
Новая техника abliteration для Qwen3.6-35B с сохранением нормы векторов. Открытый датасет, результаты бенчмарков и инструкция по запуску.
11
KVAE-Audio: новый аудиотокенизатор от Сбера с открытым кодом — обзор, установка и сравнение с аналогами
Разбор KVAE-Audio от Сбера: архитектура VAE, бенчмарки, установка, примеры использования и сравнение с EnCodec, DAC, SoundStream. Кому подойдет токенизатор?
12
LFM2.5-230M: Как я поселил языковую модель на Raspberry Pi и она не сдохла
Обзор Liquid LFM2.5-230M: 230M параметров, 42 ток/с на Raspberry Pi 5, работает на телефоне. Сравнение с Falcon-H1-Tiny, LFM2.5-1.2B-Thinking. Гайд по запуску.