Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

1920 материалов
01 Odysseus от PewDiePie: обзор self-hosted AI workspace для приватной работы с LLM и агентами Разбираем Odysseus — open-source AI-хаб от PewDiePie. Чат, агенты, своя память и полный контроль над данными. Сравнение с альтернативами, примеры и вердикт. 4 мин чтения 02 VibeETL: быстрая визуальная альтернатива Alteryx на Polars и React Flow — обзор и возможности Обзор VibeETL — open-source визуального ETL на Polars и React Flow. Сравнение с Alteryx, примеры, кому подойдет. Бесплатный drag-and-drop конструктор пайплайнов 4 мин чтения 03 Добавляем MoE-руки к замороженному Mamba: создание 2.54B модели на одной RTX 3060 с разбором ошибок Собираем гибрид Mamba и MoE на 12GB VRAM: от архитектуры до дистилляции DeepSeek CoT. Разбираем взрыв PreNorm, SSM-повторения и учим модель рассуждать. 7 мин чтения 04 Как запустить NVIDIA Parakeet локально с GGUF‑квантованием: порт на ggml и сравнение с NeMo Как запустить ASR модель NVIDIA Parakeet без Python на CPU/GPU с GGUF квантованием. Сравнение с NeMo, примеры команд, кому подойдет. 5 мин чтения 05 mlx-Chronos: мерило правды среди MLX-движков — открытый бенчмарк и лидерборд для Mac Как объективно сравнить MLX, llama.cpp, RunAnywhere.ai на Mac? mlx-Chronos — стандартизированные тесты и лидерборд. Инструкция по запуску и примеры. 3 мин чтения 06 APEX-MTP-GGUF для Qwen3.6-35B-A3B-Claude-4.7: квантование, которое ест только H100 и не подавится Новое APEX-квантование для MoE-модели Qwen3.6-35B с дистилляцией Claude Opus. Требования к железу, сравнение с Q4_K_M и TurboQuant, примеры запуска на DGX Spark 7 мин чтения 07 DeepSeek-V4: Architecture Deep Dive for Long-Context Agentic Workloads (1M Token Context) Разбираем архитектуру DeepSeek-V4 с контекстом 1 млн токенов: как 27% FLOPs reduction и оптимизация KV cache меняют правила для агентов. Сравнение с GPT-4, Gemi 6 мин чтения 08 Ettin Reranker Family: шесть гильотин для посредственного поиска. И да, код обучения открыт Разбор Ettin Reranker от Sentence Transformers: ModernBERT, дистилляция, сравнение с Cohere и BGE, примеры использования. Кому подойдут и как кастомизировать. 6 мин чтения 09 DiffuJudge-AV: калиброванная оценка видеомоделей через Tweedie-денойзинг Обзор DiffuJudge-AV — фреймворка для калибровки LLM-судей при оценке видео. Методология Tweedie posterior mean, сравнение с LingoQA, примеры использования. 4 мин чтения 10 Qdrant TurboQuant: сжимаем векторную память без потерь для production-поиска Разбор Qdrant TurboQuant — онлайн-квантование эмбеддингов без калибровки. Сравнение со скалярным и бинарным квантованием, примеры кода и эксперименты. 5 мин чтения 11 Fulloch V2: 100% локальный голосовой ассистент для Home Assistant и Obsidian на 16GB VRAM Обзор полностью локального голосового ассистента Fulloch V2 с открытым кодом. Работает на 16GB VRAM, интегрируется с Home Assistant и Obsidian. Примеры, сравнен 5 мин чтения 12 Vidai Community: один Rust-бинар для контроля затрат, guardrails и multi-provider роутинга LLM-запросов Обзор Vidai Community — open-source Rust-инструмента, который объединяет multi-provider роутинг, guardrails и учёт затрат в одном бинарнике. Сравнение с LiteLLM 1 мин чтения