Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

1920 материалов
01 DeepSeek V4: как open-source MoE с 1M контекстом переворачивает правила игры Разбираем DeepSeek V4: открытая архитектура MoE, гибридное внимание и 1 миллион токенов. Сравнение с Qwen, Llama, примеры локального запуска. 6 мин чтения 02 Context Graph Memory для мультиагентов: 88.9% точности при 26.9 токенах на запрос — новый стандарт памяти? Новый подход к памяти для мультиагентов на основе графа контекста: 88.9% точности, 26.9 токенов на запрос. Сравнение с RAG, код и бенчмарки. Кому подойдет? 6 мин чтения 03 Автоматическое редактирование документов с помощью Qwen 2.5 27B и Pi-агента: пошаговое руководство Пошаговое руководство по созданию агентного пайплайна для цензурирования документов с помощью Qwen 2.5 27B и Pi-агента. Узнайте, как автоматизировать redaction. 6 мин чтения 04 Mellum2: обзор 12B Mixture-of-Experts модели JetBrains с активными 2.5B параметрами Обзор Mellum2 — быстрой MoE-модели от JetBrains: 12B параметров с 2.5B активными, Apache 2.0, low-latency, бенчмарки, квантование, примеры использования для RAG 6 мин чтения 05 CUGA от IBM: Собираем AI-агента за 10 минут без боли. Легкий open-source каркас, который хоронит LangChain (с кодом) Разбираем CUGA — open-source инструмент от IBM для создания AI-агентов. Сравнение с LangChain, примеры кода, конфигурация и места, где он реально пашет. 6 мин чтения 06 ModelRegistry: как я перестал ждать загрузки LLM и полюбил торренты (с резервным планом) ModelRegistry — утилита, которая качает открытые модели через BitTorrent с веб-сидами от Hugging Face. Скорость, надёжность и никаких прерванных загрузок. Подро 6 мин чтения 07 ChatGPT Multi Pane: как скрестить ChatGPT с многооконностью и забыть о лимитах Codex Обзор плагина ChatGPT Multi Pane: мультипанель, агентный цикл, обход лимитов, установка из GitHub. Сравнение с Codex и Codex-lb. 7 мин чтения 08 RAGpad: Терминальный блокнот с локальным ИИ, который не сливает ваши заметки Privacy-focused приложение для заметок с RAG в терминале. Работает оффлайн на llama.cpp. Сравнение с Obsidian, NotebookLM, примеры использования. 4 мин чтения 09 SpectralQuant выжимает 96.5% точности BF16 из Q4_K_M: как калибровка чинит квантование для Qwen3.5 0.8B SpectralQuant — калибровочно-осведомлённое квантование Q4_K_M с восстановлением 96.5% точности BF16. Сравнение с альтернативами, примеры, рекомендации. Техничес 4 мин чтения 10 ContextForge: SDK для бесконечного контекста LLM с долгосрочной памятью — обзор и установка Обзор open-source SDK ContextForge, который решает проблему ограниченного контекста LLM. Установка, примеры кода, сравнение с LCME и NGT Memory. 6 мин чтения 11 Скальпель для голоса: как собрать локальный медицинский стенограф на MacBook без интернета и компромиссов Обзор локального медицинского STT на MacBook: Parakeet 0.6B, Whisper, MLX. Реальное время, конфиденциальность, точность до 95%. Сравнение с Dragon Medical и Goo 5 мин чтения 12 Как объединить RTX 5080 и RTX 4060 для инференса LLM: гайд по гетерогенной сборке Пошаговая инструкция: как скрестить RTX 5080 и RTX 4060 в одной системе для инференса больших языковых моделей. Тесты с Qwen, реальные цифры, грабли и советы. 7 мин чтения