Тематическая лента
Подборка материалов
Публикации, объединённые общей практической задачей.
1920
материалов
01
Запуск MiniMax M3 EAGLE3 на llama.cpp: конвертация в GGUF и ускорение инференса с помощью драфт-модели
Инструкция по конвертации драфт-модели MiniMax M3 EAGLE3 в GGUF для llama.cpp. Ускорение инференса на multi-GPU с 2.3 до 5 tk/s.
02
Microsoft Fast Context: open-source ускоритель, который перевернул представление о длинных контекстах
Open-source библиотека от Microsoft для ускорения обработки контекстов до 1M+ токенов. Сравнение с альтернативами, примеры кода, кому подойдет.
03
Контрастивный ковектор: хирургический скальпель для refusal-направления в LLM, который не калечит модель
Математический оператор ablation для точного удаления отказов LLM без нарушения полезного поведения. Сравнение с Apostate, Heretic, Refusal Steering. Примеры и
04
Qt Creator 20: локальный AI в офлайне — когда IDE сама дописывает код без отправки данных в облако
Полный гайд по интеграции локальных LLM в Qt Creator 20: от установки модели до автодополнения и рефакторинга C++ кода. Сравнение с Copilot, Ollama и Continue.d
05
Moebius: 0.2B модель для Image Inpainting с производительностью на уровне 10B — установка и тестирование
Обзор Moebius — 0.2B модель для inpainting, работающая как 10B. Установка, тесты, сравнение с аналогами. Кому подойдет и как запустить локально.
06
skill-compass — хук для Claude Code, который сам находит нужные скиллы (и вам не нужно гадать)
Skill-compass — хук для Claude Code на Node.js, который анализирует задачу и сам подключает нужные скиллы. Как работает, примеры, сравнение с ручным подбором и
07
Локальный AI-переводчик с потоковым выводом: собираем open-source решение, которое не сливает данные
Подробный обзор и пошаговая инструкция по созданию локального переводчика с потоковым выводом на базе open-source моделей. Защита данных, работа офлайн, сравнен
08
NUMA Mirror в llama.cpp: как выжать максимум из многосокетных серверов без боли
Разбор нового режима NUMA mirror в форке ik_llama.cpp: как он решает проблему межсокетного доступа к памяти и удваивает скорость инференса на серверных CPU.
09
Qwen 3.6 27B Abliterated: удаление безопасностных ограничений с минимальной потерей качества
Инструмент Apostate для аблайтерации Qwen 3.6 27B: удаление safety alignment с потерей менее 1% качества. Сравнение с альтернативами, примеры запуска и рекоменд
10
Как ИИ-агенты автоматизируют бэкпорты в Valkey: опыт форка Redis
Реальный кейс: как AI-агент берет на себя бэкпортирование коммитов в Valkey, разрешает merge-конфликты, проверяет лицензии и тесты. Опыт форка Redis.
11
SnarkRoute: строим нодовые редакторы для AI, которые не привязаны к фабрике
Разбираем SnarkRoute: протокол Open Route Protocol, портабельные ноды и route.yaml. Кому нужен этот open-source конструктор и почему он лучше ComfyUI и LangFlow
12
OCC-RAG: маленькие модели, которые отвечают только по делу (0.6B и 1.7B)
Обзор OCC-RAG: компактные SLM от AIRI с фокусом на faithfulness, открытые веса в GGUF. Как запустить, сравнение с альтернативами и практические примеры.