Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

1920 материалов
01 Abliterlitics: как сравнить 5 методов аблайтерации Qwen3.6-27B с помощью бенчмарков и анализа весов Открытый инструмент Abliterlitics для объективного сравнения 5 методов снятия цензуры на Qwen3.6-27B: бенчмарки, тесты безопасности, анализ весов. Экономит GPU- 1 мин чтения 02 TRL v1.0: 75 методов пост-тренинга в одной библиотеке — как Hugging Face сломала старые шаблоны TRL v1.0 от Hugging Face: 75+ методов пост-тренинга LLM, новая архитектура, примеры DPO/ORPO, сравнение с альтернативами. Кому подходит? 4 мин чтения 03 Gemma 4: почему Google наконец-то сделала open-source модель, которую стоит запускать локально Google выпустила Gemma 4 под Apache 2.0: мультимодальная модель для аудио, изображений и текста. Интеграция с llama.cpp, MLX, WebGPU. Что умеет и кому подойдет? 6 мин чтения 04 OpenReader: твой личный сервер для чтения документов вслух (и это open-source) Установи OpenReader на свой сервер: читай EPUB, PDF, DOCX с синхронной подсветкой и TTS. Скачай аудиокнигу локально. Бесплатно, без облаков. 5 мин чтения 05 Build your own Clawdmeter: Как я собрал десктопный дашборд для токенов Claude Code и перестал просыпаться в холодном поту Пошаговое руководство по сборке физического дашборда для мониторинга расхода токенов Claude Code в реальном времени. Сравнение с софтверными решениями, примеры 6 мин чтения 06 StRuCom: датасет, который научит LLM писать докстринги по-русски (и это не шутка) Датасет StRuCom решает проблему русскоязычной документации кода. Сравнение с CodeSearchNet, примеры дообучения модели и инструкция по применению. 4 мин чтения 07 MTP merging в llama.cpp: как ускорение мульти-токен предикшена изменит локальный инференс Разбираемся, как слияние PR Multi-Token Prediction в llama.cpp ускоряет генерацию на 30-50% и меняет правила игры для локальных LLM. 5 мин чтения 08 Axera AX650N на стероидах: как китайский SoC за $100 уделывает Jetson в YOLO, Depth Anything и Qwen3 Полный бенчмарк платы MaiX4 Hat на Axera AX650N: 36.8 TOPS NPU, YOLOv12 (140 fps), Depth Anything v3 (87 fps), Qwen3-1.8B (23 tok/s). Сравнение с Jetson Orin Na 6 мин чтения 09 Waypoint-1.5: интерактивные миры на обычных GPU – обзор и запуск на RTX 3090-5090 Полный обзор Waypoint-1.5 — модели, превращающей текст в интерактивные 3D-миры на потребительских GPU. Тесты на RTX 3090, 4090, 5090, сравнение с аналогами, инс 6 мин чтения 10 Grapheteria и другие: обзор опенсорсных GUI для управления AI-агентами Обзор Grapheteria — визуального конструктора агентов с MCP-серверами. Сравнение с Agno, AgentCommander, OpenAgent и UI-TARS. Кому подойдут и как упрощают жизнь. 5 мин чтения 11 Claude решил задачу Кнута за час: как OpenArx меняет научную инфраструктуру Дональд Кнут признал мощь Claude: нейросеть за час решила его задачу благодаря OpenArx — открытой MCP-инфраструктуре. Как это изменит научные исследования? 3 мин чтения 12 Self-hosted MCP сервер для финансовых данных: как подключить любой локальный LLM к реальным данным SEC, 13F и биржевым инсайдам Как поднять свой MCP-сервер для финансовых данных, прикрутить к локальному LLM и получать свежие 13F, SEC filings и инсайдерские сделки без единого API-ключа. 6 мин чтения