Тематическая лента
Подборка материалов
Публикации, объединённые общей практической задачей.
1920
материалов
01
PickyTrain: Обзор open-source редактора весов GGUF-моделей для хирургического редактирования без GPU
PickyTrain - open-source инструмент на Rust для хирургического редактирования весов GGUF-моделей. Работает без GPU, позволяет модифицировать квантованные модели
02
Нейро-символическая модель XAI для фрод-детекшн: как ускорить объяснения в 33 раза с детерминированными результатами
Как нейро-символическая модель XAI ускоряет объяснения фрод-детекшн до 0.9 мс с детерминированными результатами. Сравнение с SHAP KernelExplainer, примеры на Ka
03
TurboQuant в Alibaba MNN: новый метод квантования для ускорения моделей
Обзор TurboQuant в Alibaba MNN 3.0.0. Сравнение с GPTQ, AWQ, бенчмарки и инструкция по использованию для оптимизации нейросетей.
04
GStack: разбор фабрики ИИ-работяг от CEO Y Combinator на базе Claude Code
Подробный обзор GStack — open-source инструмента для автоматизации разработки. Анализ возможностей, сравнение с аналогами, примеры использования и рекомендации
05
Бюджетные GPU для LLM: какую карту за копейки взять в 2026 году
Практическое сравнение бюджетных GPU для запуска локальных нейросетей. Таблицы скорости, реальные токены в секунду и советы по выбору карты до $250.
06
ZINC: новый движок для вывода LLM на Zig, запускающий 35B модели на бюджетных AMD GPU
ZINC — inference-движок на Zig и Vulkan. Запускает 35B модели на дешевых AMD видеокартах. Сравнение с llama.cpp, vLLM и ZLUDA.
07
AI Doomsday Toolbox: ваш швейцарский нож для локального ИИ на Android в 2026
Глубокий разбор AI Doomsday Toolbox: как запускать LLM, тестировать модели и создавать датасеты на смартфоне. Актуально на март 2026.
08
TurboQuant: онлайн-квантование векторов без калибровки — разбор реализации на Python
Обзор TurboQuant - метода онлайн-квантования векторов без калибровки. Сравнение с аналогами, примеры использования и рекомендации для инженеров в 2026.
09
Обучаем LLM с нуля для языка луганда и запускаем на Android без GPU: социальный AI в действии
Практический опыт создания языковой модели для языка луганда с нуля и её оптимизация для работы на мобильных устройствах без GPU. Примеры и сравнение с альтерна
10
Tinylora: как тонкая настройка LoRA работает всего с 13 параметрами — эксперименты и код
Обзор Tinylora — прорывной техники тонкой настройки LLM всего с 13 глобальными параметрами. Эксперименты на Qwen3.5, код и сравнение с обычной LoRA.
11
Tokentap: MitM-прокси для мониторинга токенов и запросов к LLM — установка и использование
Обзор Tokentap - MitM-прокси для контроля токенов и безопасности запросов к LLM. Установка через pipx, примеры, сравнение с аналогами.
12
Обзор Agentic RAG System: продвинутая реализация с инструментами и оценкой
Глубокий разбор продвинутой Agentic RAG системы с инструментами и встроенной оценкой. Сравнение с аналогами, архитектура на FastAPI и pgvector, кому подойдет в