Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

1920 материалов
01 Запуск MiniMax M3 EAGLE3 на llama.cpp: конвертация в GGUF и ускорение инференса с помощью драфт-модели Инструкция по конвертации драфт-модели MiniMax M3 EAGLE3 в GGUF для llama.cpp. Ускорение инференса на multi-GPU с 2.3 до 5 tk/s. 6 мин чтения 02 Microsoft Fast Context: open-source ускоритель, который перевернул представление о длинных контекстах Open-source библиотека от Microsoft для ускорения обработки контекстов до 1M+ токенов. Сравнение с альтернативами, примеры кода, кому подойдет. 4 мин чтения 03 Контрастивный ковектор: хирургический скальпель для refusal-направления в LLM, который не калечит модель Математический оператор ablation для точного удаления отказов LLM без нарушения полезного поведения. Сравнение с Apostate, Heretic, Refusal Steering. Примеры и 1 мин чтения 04 Qt Creator 20: локальный AI в офлайне — когда IDE сама дописывает код без отправки данных в облако Полный гайд по интеграции локальных LLM в Qt Creator 20: от установки модели до автодополнения и рефакторинга C++ кода. Сравнение с Copilot, Ollama и Continue.d 1 мин чтения 05 Moebius: 0.2B модель для Image Inpainting с производительностью на уровне 10B — установка и тестирование Обзор Moebius — 0.2B модель для inpainting, работающая как 10B. Установка, тесты, сравнение с аналогами. Кому подойдет и как запустить локально. 5 мин чтения 06 skill-compass — хук для Claude Code, который сам находит нужные скиллы (и вам не нужно гадать) Skill-compass — хук для Claude Code на Node.js, который анализирует задачу и сам подключает нужные скиллы. Как работает, примеры, сравнение с ручным подбором и 4 мин чтения 07 Локальный AI-переводчик с потоковым выводом: собираем open-source решение, которое не сливает данные Подробный обзор и пошаговая инструкция по созданию локального переводчика с потоковым выводом на базе open-source моделей. Защита данных, работа офлайн, сравнен 5 мин чтения 08 NUMA Mirror в llama.cpp: как выжать максимум из многосокетных серверов без боли Разбор нового режима NUMA mirror в форке ik_llama.cpp: как он решает проблему межсокетного доступа к памяти и удваивает скорость инференса на серверных CPU. 7 мин чтения 09 Qwen 3.6 27B Abliterated: удаление безопасностных ограничений с минимальной потерей качества Инструмент Apostate для аблайтерации Qwen 3.6 27B: удаление safety alignment с потерей менее 1% качества. Сравнение с альтернативами, примеры запуска и рекоменд 4 мин чтения 10 Как ИИ-агенты автоматизируют бэкпорты в Valkey: опыт форка Redis Реальный кейс: как AI-агент берет на себя бэкпортирование коммитов в Valkey, разрешает merge-конфликты, проверяет лицензии и тесты. Опыт форка Redis. 6 мин чтения 11 SnarkRoute: строим нодовые редакторы для AI, которые не привязаны к фабрике Разбираем SnarkRoute: протокол Open Route Protocol, портабельные ноды и route.yaml. Кому нужен этот open-source конструктор и почему он лучше ComfyUI и LangFlow 5 мин чтения 12 OCC-RAG: маленькие модели, которые отвечают только по делу (0.6B и 1.7B) Обзор OCC-RAG: компактные SLM от AIRI с фокусом на faithfulness, открытые веса в GGUF. Как запустить, сравнение с альтернативами и практические примеры. 6 мин чтения