Тематическая лента
Подборка материалов
Публикации, объединённые общей практической задачей.
1920
материалов
01
Abliterlitics: как сравнить 5 методов аблайтерации Qwen3.6-27B с помощью бенчмарков и анализа весов
Открытый инструмент Abliterlitics для объективного сравнения 5 методов снятия цензуры на Qwen3.6-27B: бенчмарки, тесты безопасности, анализ весов. Экономит GPU-
02
TRL v1.0: 75 методов пост-тренинга в одной библиотеке — как Hugging Face сломала старые шаблоны
TRL v1.0 от Hugging Face: 75+ методов пост-тренинга LLM, новая архитектура, примеры DPO/ORPO, сравнение с альтернативами. Кому подходит?
03
Gemma 4: почему Google наконец-то сделала open-source модель, которую стоит запускать локально
Google выпустила Gemma 4 под Apache 2.0: мультимодальная модель для аудио, изображений и текста. Интеграция с llama.cpp, MLX, WebGPU. Что умеет и кому подойдет?
04
OpenReader: твой личный сервер для чтения документов вслух (и это open-source)
Установи OpenReader на свой сервер: читай EPUB, PDF, DOCX с синхронной подсветкой и TTS. Скачай аудиокнигу локально. Бесплатно, без облаков.
05
Build your own Clawdmeter: Как я собрал десктопный дашборд для токенов Claude Code и перестал просыпаться в холодном поту
Пошаговое руководство по сборке физического дашборда для мониторинга расхода токенов Claude Code в реальном времени. Сравнение с софтверными решениями, примеры
06
StRuCom: датасет, который научит LLM писать докстринги по-русски (и это не шутка)
Датасет StRuCom решает проблему русскоязычной документации кода. Сравнение с CodeSearchNet, примеры дообучения модели и инструкция по применению.
07
MTP merging в llama.cpp: как ускорение мульти-токен предикшена изменит локальный инференс
Разбираемся, как слияние PR Multi-Token Prediction в llama.cpp ускоряет генерацию на 30-50% и меняет правила игры для локальных LLM.
08
Axera AX650N на стероидах: как китайский SoC за $100 уделывает Jetson в YOLO, Depth Anything и Qwen3
Полный бенчмарк платы MaiX4 Hat на Axera AX650N: 36.8 TOPS NPU, YOLOv12 (140 fps), Depth Anything v3 (87 fps), Qwen3-1.8B (23 tok/s). Сравнение с Jetson Orin Na
09
Waypoint-1.5: интерактивные миры на обычных GPU – обзор и запуск на RTX 3090-5090
Полный обзор Waypoint-1.5 — модели, превращающей текст в интерактивные 3D-миры на потребительских GPU. Тесты на RTX 3090, 4090, 5090, сравнение с аналогами, инс
10
Grapheteria и другие: обзор опенсорсных GUI для управления AI-агентами
Обзор Grapheteria — визуального конструктора агентов с MCP-серверами. Сравнение с Agno, AgentCommander, OpenAgent и UI-TARS. Кому подойдут и как упрощают жизнь.
11
Claude решил задачу Кнута за час: как OpenArx меняет научную инфраструктуру
Дональд Кнут признал мощь Claude: нейросеть за час решила его задачу благодаря OpenArx — открытой MCP-инфраструктуре. Как это изменит научные исследования?
12
Self-hosted MCP сервер для финансовых данных: как подключить любой локальный LLM к реальным данным SEC, 13F и биржевым инсайдам
Как поднять свой MCP-сервер для финансовых данных, прикрутить к локальному LLM и получать свежие 13F, SEC filings и инсайдерские сделки без единого API-ключа.