Тематическая лента
Подборка материалов
Публикации, объединённые общей практической задачей.
1920
материалов
01
Odysseus от PewDiePie: обзор self-hosted AI workspace для приватной работы с LLM и агентами
Разбираем Odysseus — open-source AI-хаб от PewDiePie. Чат, агенты, своя память и полный контроль над данными. Сравнение с альтернативами, примеры и вердикт.
02
VibeETL: быстрая визуальная альтернатива Alteryx на Polars и React Flow — обзор и возможности
Обзор VibeETL — open-source визуального ETL на Polars и React Flow. Сравнение с Alteryx, примеры, кому подойдет. Бесплатный drag-and-drop конструктор пайплайнов
03
Добавляем MoE-руки к замороженному Mamba: создание 2.54B модели на одной RTX 3060 с разбором ошибок
Собираем гибрид Mamba и MoE на 12GB VRAM: от архитектуры до дистилляции DeepSeek CoT. Разбираем взрыв PreNorm, SSM-повторения и учим модель рассуждать.
04
Как запустить NVIDIA Parakeet локально с GGUF‑квантованием: порт на ggml и сравнение с NeMo
Как запустить ASR модель NVIDIA Parakeet без Python на CPU/GPU с GGUF квантованием. Сравнение с NeMo, примеры команд, кому подойдет.
05
mlx-Chronos: мерило правды среди MLX-движков — открытый бенчмарк и лидерборд для Mac
Как объективно сравнить MLX, llama.cpp, RunAnywhere.ai на Mac? mlx-Chronos — стандартизированные тесты и лидерборд. Инструкция по запуску и примеры.
06
APEX-MTP-GGUF для Qwen3.6-35B-A3B-Claude-4.7: квантование, которое ест только H100 и не подавится
Новое APEX-квантование для MoE-модели Qwen3.6-35B с дистилляцией Claude Opus. Требования к железу, сравнение с Q4_K_M и TurboQuant, примеры запуска на DGX Spark
07
DeepSeek-V4: Architecture Deep Dive for Long-Context Agentic Workloads (1M Token Context)
Разбираем архитектуру DeepSeek-V4 с контекстом 1 млн токенов: как 27% FLOPs reduction и оптимизация KV cache меняют правила для агентов. Сравнение с GPT-4, Gemi
08
Ettin Reranker Family: шесть гильотин для посредственного поиска. И да, код обучения открыт
Разбор Ettin Reranker от Sentence Transformers: ModernBERT, дистилляция, сравнение с Cohere и BGE, примеры использования. Кому подойдут и как кастомизировать.
09
DiffuJudge-AV: калиброванная оценка видеомоделей через Tweedie-денойзинг
Обзор DiffuJudge-AV — фреймворка для калибровки LLM-судей при оценке видео. Методология Tweedie posterior mean, сравнение с LingoQA, примеры использования.
10
Qdrant TurboQuant: сжимаем векторную память без потерь для production-поиска
Разбор Qdrant TurboQuant — онлайн-квантование эмбеддингов без калибровки. Сравнение со скалярным и бинарным квантованием, примеры кода и эксперименты.
11
Fulloch V2: 100% локальный голосовой ассистент для Home Assistant и Obsidian на 16GB VRAM
Обзор полностью локального голосового ассистента Fulloch V2 с открытым кодом. Работает на 16GB VRAM, интегрируется с Home Assistant и Obsidian. Примеры, сравнен
12
Vidai Community: один Rust-бинар для контроля затрат, guardrails и multi-provider роутинга LLM-запросов
Обзор Vidai Community — open-source Rust-инструмента, который объединяет multi-provider роутинг, guardrails и учёт затрат в одном бинарнике. Сравнение с LiteLLM