Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

1920 материалов
01 Собираем AI-агента с Strands и Amazon Bedrock: полный гайд по развертыванию в облаке Как собрать AI-агента на открытом фреймворке Strands и запустить в облаке через Amazon Bedrock. Примеры кода, сравнение с альтернативами, советы по настройке. 6 мин чтения 02 Hister: гугл для AI-агента, который не сливает ваши данные в облако Разбираем Hister — self-hosted поисковик с MCP-эндпоинтом, который даёт локальному AI-ассистенту долговременную память. Сравнение с альтернативами, примеры наст 7 мин чтения 03 openPangu-2.0-Flash: китайский LLM, который заставит вас пересмотреть понятие «быстро» Китайская LLM openPangu-2.0-Flash с Flash-архитектурой: обзор возможностей, сравнение с Qwen, GLM-4.7 Flash, MiMo-V2, тесты и кому подойдет. Обновлено 2026. 5 мин чтения 04 audio.cpp: запускаем VibeVoice 1.5B на C++/ggml в 4 раза быстрее реального времени Порт VibeVoice 1.5B на C++/ggml даёт 4.08x real-time на RTX 5090 и 2.86x ускорение против Python. Обзор возможностей, бенчмарки и примеры использования. 4 мин чтения 05 Запуск Agents-A1 GGUF: 35B Qwen3.5-MoE, NVFP4 для Blackwell и MTP speculative decoding с ускорением 1.22x Вышли GGUF-кванты агентной модели Agents-A1 на базе Qwen3.5-MoE с поддержкой NVFP4 для Blackwell и MTP speculative decoding. Ускорение 1.22x, детали. 3 мин чтения 06 Claude Sonnet 5: агентный бюджетник, который заставит Opus нервно курить в сторонке Обзор Claude Sonnet 5 — агентной модели Anthropic с низкой ценой API. Сравнение с Opus 4.8, тесты автономности, цена за токен, кому подойдет. 6 мин чтения 07 PageStorm: как локальная модель для книг заменяет ChatGPT и не боится тормозов Полный обзор PageStorm — open-source LLM для писателей. Локальный запуск, генерация глав, контроль сюжета. Сравнение с Claude и Llama, реальные примеры промптов 6 мин чтения 08 TurboOCR v3: как запустить высокоскоростной сервер OCR на C++/CUDA (до 520 img/с на RTX 5090) Обзор TurboOCR v3 — высокоскоростного OCR сервера на C++/CUDA с моделью PP-OCRv6 tiny. Разбор архитектуры, бенчмарки RTX 5090, сравнение с PaddleOCR и DharmaOCR 6 мин чтения 09 Как стандартизировать отчеты об оценках ИИ: разбираем JSON-схему EEE от Hugging Face Разбираем JSON-схему EEE для унификации метрик моделей. Сравнение с альтернативами, примеры использования, кому подойдет инструмент. 6 мин чтения 10 Norm-preserving abliteration на Qwen3.6-35B: как снять цензуру без потери качества (датасет открыт) Новая техника abliteration для Qwen3.6-35B с сохранением нормы векторов. Открытый датасет, результаты бенчмарков и инструкция по запуску. 4 мин чтения 11 KVAE-Audio: новый аудиотокенизатор от Сбера с открытым кодом — обзор, установка и сравнение с аналогами Разбор KVAE-Audio от Сбера: архитектура VAE, бенчмарки, установка, примеры использования и сравнение с EnCodec, DAC, SoundStream. Кому подойдет токенизатор? 5 мин чтения 12 LFM2.5-230M: Как я поселил языковую модель на Raspberry Pi и она не сдохла Обзор Liquid LFM2.5-230M: 230M параметров, 42 ток/с на Raspberry Pi 5, работает на телефоне. Сравнение с Falcon-H1-Tiny, LFM2.5-1.2B-Thinking. Гайд по запуску. 4 мин чтения