Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

1920 материалов
01 HyperNova-60B: когда можно решать сложные задачи, но не хочется платить за все 120 миллиардов параметров Практичный обзор HyperNova-60B: MoE-архитектура, MXFP4 квантование, настройка reasoning усилителя и экономия VRAM. Для кого подойдет эта модель? 8 мин чтения 02 GLM-4.7-REAP-40p IQ3_S на RTX 6000: хватит ли 48 ГБ для SWE-Bench? Запускаем GLM-4.7-REAP-40p с квантованием IQ3_S на RTX 6000, тестируем на реальных задачах SWE-Bench. Полный код, результаты, сравнение с альтернативами. 7 мин чтения 03 Flow Protocol: как развернуть децентрализованную сеть для нецензурируемого AI-инференса на своём GPU Как запустить Flow Protocol на своей видеокарте. Настройка децентрализованной P2P сети для нецензурируемого AI-инференса и майнинга. Полный гайд. 7 мин чтения 04 Models Explorer: как найти open-source альтернативу любой AI-модели за 30 секунд Обзор инструмента Models Explorer для поиска open-weight альтернатив, сравнения моделей и расчета стоимости токенов. 7 мин чтения 05 SAM-Audio без боли: CLI-интерфейс, который экономит 4 ГБ VRAM и ваши нервы Как установить SAM-Audio на свой компьютер с минимальными требованиями к видеопамяти. Решение проблем с зависимостями Python и оптимизация VRAM. 4 мин чтения 06 Ragex: как создать гибридный RAG для анализа кода на Elixir с AST и графами знаний Как создать гибридный RAG для семантического поиска по коду на Elixir. AST-парсинг, векторные эмбеддинги и графы знаний в одном инструменте. 8 мин чтения 07 50 миллионов параметров против триллиона: Как Chess GPT обыгрывает ChatGPT в шахматы Тестируем Chess GPT - 50-миллионную модель, которая играет в шахматы лучше ChatGPT. Как работает PGN трансформер, где найти демо и почему специализация важнее р 6 мин чтения 08 Llama.cpp больше не мучает: веб-центр с мозгом, который сам подбирает параметры Обзор инструмента для автоматизации llama.cpp: веб-интерфейс, умный подбор n_gpu_layers и n_ctx, мониторинг и управление процессами через FastAPI. 6 мин чтения 09 Обзор Seline: приватный AI-ассистент с векторами, пайплайнами и локальной установкой Обзор Seline - приватного AI-ассистента с векторной БД, пайплайнами LLM и установкой в один клик. Сравнение с альтернативами, примеры использования. 4 мин чтения 10 Maincoder-1B: как запустить новую 1-миллиардную модель для кодинга через llama.cpp Пошаговая инструкция по запуску легкой модели Maincoder-1B для программирования через llama.cpp. Скачивание GGUF, настройка, примеры кода и сравнение. 5 мин чтения 11 Как 50-миллионный трансформер играет в шахматы лучше ChatGPT: тестируем Chess GPT без поиска Тестируем Chess GPT - 50M параметров, играет в шахматы лучше ChatGPT. Архитектура nanoGPT, PGN формат, доменное обучение. 4 мин чтения 12 Temporal LoRA: как динамический адаптер-роутер переключает контексты с 100% точностью (PoC на GPT-2) Экспериментальная архитектура Temporal LoRA решает проблему смешения адаптеров. Динамический роутер переключает контексты без катастрофического забывания. PoC н 6 мин чтения