Тематическая лента
Подборка материалов
Публикации, объединённые общей практической задачей.
1920
материалов
01
DeepSeek V4: как open-source MoE с 1M контекстом переворачивает правила игры
Разбираем DeepSeek V4: открытая архитектура MoE, гибридное внимание и 1 миллион токенов. Сравнение с Qwen, Llama, примеры локального запуска.
02
Context Graph Memory для мультиагентов: 88.9% точности при 26.9 токенах на запрос — новый стандарт памяти?
Новый подход к памяти для мультиагентов на основе графа контекста: 88.9% точности, 26.9 токенов на запрос. Сравнение с RAG, код и бенчмарки. Кому подойдет?
03
Автоматическое редактирование документов с помощью Qwen 2.5 27B и Pi-агента: пошаговое руководство
Пошаговое руководство по созданию агентного пайплайна для цензурирования документов с помощью Qwen 2.5 27B и Pi-агента. Узнайте, как автоматизировать redaction.
04
Mellum2: обзор 12B Mixture-of-Experts модели JetBrains с активными 2.5B параметрами
Обзор Mellum2 — быстрой MoE-модели от JetBrains: 12B параметров с 2.5B активными, Apache 2.0, low-latency, бенчмарки, квантование, примеры использования для RAG
05
CUGA от IBM: Собираем AI-агента за 10 минут без боли. Легкий open-source каркас, который хоронит LangChain (с кодом)
Разбираем CUGA — open-source инструмент от IBM для создания AI-агентов. Сравнение с LangChain, примеры кода, конфигурация и места, где он реально пашет.
06
ModelRegistry: как я перестал ждать загрузки LLM и полюбил торренты (с резервным планом)
ModelRegistry — утилита, которая качает открытые модели через BitTorrent с веб-сидами от Hugging Face. Скорость, надёжность и никаких прерванных загрузок. Подро
07
ChatGPT Multi Pane: как скрестить ChatGPT с многооконностью и забыть о лимитах Codex
Обзор плагина ChatGPT Multi Pane: мультипанель, агентный цикл, обход лимитов, установка из GitHub. Сравнение с Codex и Codex-lb.
08
RAGpad: Терминальный блокнот с локальным ИИ, который не сливает ваши заметки
Privacy-focused приложение для заметок с RAG в терминале. Работает оффлайн на llama.cpp. Сравнение с Obsidian, NotebookLM, примеры использования.
09
SpectralQuant выжимает 96.5% точности BF16 из Q4_K_M: как калибровка чинит квантование для Qwen3.5 0.8B
SpectralQuant — калибровочно-осведомлённое квантование Q4_K_M с восстановлением 96.5% точности BF16. Сравнение с альтернативами, примеры, рекомендации. Техничес
10
ContextForge: SDK для бесконечного контекста LLM с долгосрочной памятью — обзор и установка
Обзор open-source SDK ContextForge, который решает проблему ограниченного контекста LLM. Установка, примеры кода, сравнение с LCME и NGT Memory.
11
Скальпель для голоса: как собрать локальный медицинский стенограф на MacBook без интернета и компромиссов
Обзор локального медицинского STT на MacBook: Parakeet 0.6B, Whisper, MLX. Реальное время, конфиденциальность, точность до 95%. Сравнение с Dragon Medical и Goo
12
Как объединить RTX 5080 и RTX 4060 для инференса LLM: гайд по гетерогенной сборке
Пошаговая инструкция: как скрестить RTX 5080 и RTX 4060 в одной системе для инференса больших языковых моделей. Тесты с Qwen, реальные цифры, грабли и советы.