Тематическая лента
Подборка материалов
Публикации, объединённые общей практической задачей.
1920
материалов
01
Nex2 mini Phase Twin: 30B модель в 16GB VRAM — технологии квантования и запуск локально
Обзор Nex2 mini Phase Twin — 30-миллиардной модели, которая работает на RTX 4060/4080 благодаря новым техникам квантования. Сравнение с альтернативами, примеры
02
Qwable-v1: открытая дистиллированная версия Claude Fable 5 на Qwen3.6 — установка и квантование
Полный гайд по Qwable-v1 — модели на 35B параметров, дистиллированной из Claude Fable 5 на базе Qwen3.6. Установка, квантование, сравнение с аналогами и практич
03
Evalatro: новый открытый бенчмарк для LLM на основе игры Balatro — как тестировать рассуждения и стратегию
Открытый бенчмарк Evalatro оценивает LLM через игру Balatro: стратегия, адаптация, планирование. Код на GitHub. Сравнение с AgentBench, GSM8K.
04
OpenMythos: как мы обучили open-source LLM для кибербезопасности с помощью RLVR
Разбираем, как обучить open-source модель для анализа угроз и CVE с помощью Reinforcement Learning from Verifiable Rewards. Технические детали, датасеты, сравне
05
Gemma 4 на React Native через ExecuTorch: Vulkan и MLX будят мёртвые GPU
Как запустить Gemma 4 на мобильных устройствах через React Native с ExecuTorch. Использование Vulkan для Android и MLX для iOS. Сравнение с альтернативами.
06
ModelGrep: объединяем OpenRouter, Artificial Analysis и Design Arena в одном фильтруемом списке моделей
Обзор ModelGrep — инструмента для поиска и сравнения LLM по цене, производительности и рейтингу. Как объединить OpenRouter, Artificial Analysis и Design Arena в
07
Tower-Plus-72B-Ultra-Uncensored-Heretic: как развязать язык 22 языкам без оглядки на цензуру
Полный разбор Tower-Plus-72B-Ultra-Uncensored-Heretic: метрики KLD, поддержка 22 языков, низкий процент отказов, сравнение с Gemma 4, Polyglot-r2, Hunyuan-MT и
08
Как сделать текст человечным: обзор инструмента для обхода AI-детекции
Как заставить AI-текст звучать естественно? Обзор Humanize AI: возможности, сравнение с альтернативами, примеры использования. Узнайте, как обмануть GPTZero и O
09
Почему RTX 5090 быстрее H100 в локальном инференсе? Сравнение производительности llama.cpp
Сравнение RTX 5090 и H100 для локального инференса LLM в llama.cpp. Цифры, архитектурные причины, кому какой GPU выбрать.
10
Suno AI без случайных промптов: как собрать управляемый музыкальный workflow
Как работать с Suno AI системно: style prompts, референсы, AI-лаборатория, обложки, кастомные артисты и обратная инженерия трека по аудио.
11
Как создать учебное пособие автоматически с помощью AI-агентов: разбор конвейера из видео в PDF на примере задач IMC
Разбираем, как с помощью AI-агентов автоматически превратить запись разбора задач IMC в структурированный PDF-учебник с иллюстрациями. Шаги, инструменты, сравне
12
North Mini Code: 30B MoE-модель от Cohere для агентного кодинга – бенчмарки и запуск
Разбираем Cohere North Mini Code 1.0 – 30B MoE модель с A3B архитектурой для agentic coding. Сравнение с конкурентами, бенчмарки, примеры использования.