Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

1920 материалов
01 PickyTrain: Обзор open-source редактора весов GGUF-моделей для хирургического редактирования без GPU PickyTrain - open-source инструмент на Rust для хирургического редактирования весов GGUF-моделей. Работает без GPU, позволяет модифицировать квантованные модели 5 мин чтения 02 Нейро-символическая модель XAI для фрод-детекшн: как ускорить объяснения в 33 раза с детерминированными результатами Как нейро-символическая модель XAI ускоряет объяснения фрод-детекшн до 0.9 мс с детерминированными результатами. Сравнение с SHAP KernelExplainer, примеры на Ka 4 мин чтения 03 TurboQuant в Alibaba MNN: новый метод квантования для ускорения моделей Обзор TurboQuant в Alibaba MNN 3.0.0. Сравнение с GPTQ, AWQ, бенчмарки и инструкция по использованию для оптимизации нейросетей. 5 мин чтения 04 GStack: разбор фабрики ИИ-работяг от CEO Y Combinator на базе Claude Code Подробный обзор GStack — open-source инструмента для автоматизации разработки. Анализ возможностей, сравнение с аналогами, примеры использования и рекомендации 5 мин чтения 05 Бюджетные GPU для LLM: какую карту за копейки взять в 2026 году Практическое сравнение бюджетных GPU для запуска локальных нейросетей. Таблицы скорости, реальные токены в секунду и советы по выбору карты до $250. 7 мин чтения 06 ZINC: новый движок для вывода LLM на Zig, запускающий 35B модели на бюджетных AMD GPU ZINC — inference-движок на Zig и Vulkan. Запускает 35B модели на дешевых AMD видеокартах. Сравнение с llama.cpp, vLLM и ZLUDA. 5 мин чтения 07 AI Doomsday Toolbox: ваш швейцарский нож для локального ИИ на Android в 2026 Глубокий разбор AI Doomsday Toolbox: как запускать LLM, тестировать модели и создавать датасеты на смартфоне. Актуально на март 2026. 6 мин чтения 08 TurboQuant: онлайн-квантование векторов без калибровки — разбор реализации на Python Обзор TurboQuant - метода онлайн-квантования векторов без калибровки. Сравнение с аналогами, примеры использования и рекомендации для инженеров в 2026. 4 мин чтения 09 Обучаем LLM с нуля для языка луганда и запускаем на Android без GPU: социальный AI в действии Практический опыт создания языковой модели для языка луганда с нуля и её оптимизация для работы на мобильных устройствах без GPU. Примеры и сравнение с альтерна 5 мин чтения 10 Tinylora: как тонкая настройка LoRA работает всего с 13 параметрами — эксперименты и код Обзор Tinylora — прорывной техники тонкой настройки LLM всего с 13 глобальными параметрами. Эксперименты на Qwen3.5, код и сравнение с обычной LoRA. 6 мин чтения 11 Tokentap: MitM-прокси для мониторинга токенов и запросов к LLM — установка и использование Обзор Tokentap - MitM-прокси для контроля токенов и безопасности запросов к LLM. Установка через pipx, примеры, сравнение с аналогами. 4 мин чтения 12 Обзор Agentic RAG System: продвинутая реализация с инструментами и оценкой Глубокий разбор продвинутой Agentic RAG системы с инструментами и встроенной оценкой. Сравнение с аналогами, архитектура на FastAPI и pgvector, кому подойдет в 6 мин чтения