Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

1920 материалов
01 Как использовать и дообучить 500Мб NER-модель tanaos-NER-v1 локально на CPU с помощью Artifex Пошаговый гайд по использованию и дообучению легкой NER-модели tanaos-NER-v1 локально на CPU с библиотекой Artifex. Примеры кода на Python. 5 мин чтения 02 Как работает Confer: первый по-настоящему приватный AI-ассистент с шифрованием в TEE Как Moxie Marlinspike создал приватный AI-ассистент с шифрованием в Trusted Execution Environment. Сравнение с локальными альтернативами. 5 мин чтения 03 FrogBoss и FrogMini: как Microsoft создала AI-агентов для автоматического исправления багов в коде Как Microsoft создала FrogBoss и FrogMini - AI-агентов для автоматического исправления багов в коде. Технические детали, сравнение с альтернативами и примеры ис 3 мин чтения 04 EAFT в бою: тест на uncensor-задаче против обычного fine-tuning Практический эксперимент: сравниваем Entropy Adaptive Fine Tuning с обычным fine-tuning на задаче uncensor. Результаты, код, модели. 5 мин чтения 05 Tencent WeDLM-8B в chatllm.cpp: декодирование на грани и почему GPU иногда проигрывает Подробный обзор запуска модели WeDLM-8B в chatllm.cpp: настройка параметров block_size, accept_algo, сравнение производительности CPU и GPU. 5 мин чтения 06 Gemma 3 1B Q4_0 GGUF: как правильно квантовать QAT-модель без imatrix Пошаговая инструкция по правильному квантованию Gemma 3 1B в формат GGUF без использования imatrix. Исправление метаданных и токенизатора. 4 мин чтения 07 Baichuan-M3-235B: как медицинская LLM превзошла GPT-5.2 и какие техники снижают галлюцинации Китайская модель Baichuan-M3-235B превзошла GPT-5.2 в медицинских тестах HealthBench. Как Fact-Aware RL и W4 квантование снижают галлюцинации. 4 мин чтения 08 Как превратить любое видео в книжку-раскладушку для ребёнка: туториал по Vid2BedtimeStory Полный туториал по превращению видео в книжку-раскладушку для детей. Скриншоты, генерация текста, создание PDF. Локальные LLM и Google Play Books. 6 мин чтения 09 SurfSense: локальный ассистент, который не сливает ваши документы в облако Как развернуть SurfSense - приватный RAG-ассистент с поддержкой 100+ LLM через Ollama. Полная инструкция по Docker-установке. 6 мин чтения 10 Сжатие вывода инструментов для AI-агентов: как сократить контекст на 70% и снизить стоимость Открытая библиотека ToolTrim сжимает вывод инструментов AI-агентов на 60-70%, снижая стоимость inference. Статистическая фильтрация и удаление избыточных данных 5 мин чтения 11 MCP Hangar: как настроить единую систему управления серверами MCP для локальных LLM Настройка MCP Hangar - единой системы управления серверами MCP для локальных языковых моделей. Ленивая загрузка, мониторинг, Docker 7 мин чтения 12 GitNexus: браузерный графовый движок, который заставит Cursor и Claude Code понимать ваш код Настройте GitNexus - opensource графовый движок анализа зависимостей кода в браузере. Работает с MCP, предотвращает breaking changes для AI-ассистентов. 7 мин чтения