Тематическая лента
Подборка материалов
Публикации, объединённые общей практической задачей.
1920
материалов
01
Чистый Python вместо LLM: как собрать связанную вики из заметок без единого запроса к нейросети
Пошаговый гайд по сборке связанной вики из Markdown-заметок на чистом Python без API нейросетей. Регулярки, графы ссылок, бенчмарки и полный код.
02
Запуск Gemma 4 12B на Mac с MLX: открытый проект Helios
Проект Helios — оптимизированный запуск Gemma 4 12B на Mac через MLX. Сравнение с llama.cpp, примеры кода, тесты скорости на M5. Бесплатно и открыто.
03
Prompt Warrior: геймифицированный самоанализ логов Claude Code — инструкция по установке и использованию
Prompt Warrior — open-source инструмент для геймифицированного анализа логов Claude Code. Достижения, психологический профиль агента, локальная установка. Инстр
04
119B параметров, но мозгов — на 6B: честный тест Mistral Leanstral 1.5 и его запуск у вас дома
Разбираем Mistral Leanstral 1.5 — MoE-модель 119B с 6B активных параметров. Сравнение с DeepSeek V3.2 и Qwen3. Как запустить на домашнем сервере, квантование, р
05
Детерминированный RAG: инструмент памяти с recall 1.0 без вызовов LLM — разбор подхода
Разбор подхода к RAG, который дает 100% recall и не требует обращения к языковой модели. Как работает, где применить и почему это дешевле традиционных решений.
06
Домашний сервер для LLM на 6x P40: запуск Minimax M2.7 с квантованием Q3_XL
Подробный гайд по сборке дешёвого сервера из шести NVIDIA P40 (144 ГБ VRAM) для запуска больших языковых моделей. На примере Minimax M2.7 с квантованием Q3_XL —
07
OpenLumara Harness: токен-эффективная упряжка с OpenAI-мостом для локальных LLM
Обзор OpenLumara — супер-токен-эффективного инструмента с OpenAI Bridge для локальных моделей. Сравнение с альтернативами, примеры, кому подойдёт.
08
Первое независимое тестирование 1-битной модели Bonsai-8B для вызова инструментов на CPU: победа над IBM Granite при грамматически ограниченной декодировке
Независимый бенчмарк 1-битной Bonsai-8B для tool calling на CPU: грамматическая декодировка через llama.cpp. Bonsai-8B опередила IBM Granite в точности вызова и
09
Meta-Spider: мета-внимание для контроля поведения LLM — разбор новых компонентов
Глубокий технический обзор фреймворка Meta-Spider с новыми компонентами: ручка неуверенности, сторож и фабрика обвязок. Как это решает дрейф цели и что дает раз
10
Создаем локальный бэкенд для NPC с диалогами NPC-NPC на базе LLM
Как создать бэкенд для диалогов между NPC с помощью локальной LLM. Код, примеры, сравнение с альтернативами. Для разработчиков игр.
11
Ornith 35B FP8: локальный монстр кодинга, который не просит интернета
Разбираем Ornith 35B FP8 — локальную модель для кодинга с MTP speculative decode. Сравнение с Qwen, DeepSeek, тесты на RTX 4090 и 3090. Кому реально нужно?
12
Claude Sonnet 5: агентный апгрейд, цены и как использовать в API и Claude Code
Разбираем Claude Sonnet 5: агентные способности, цены API, примеры использования в Claude Code. Сравнение с GPT-4o и Gemini 2.0. Кому подойдет.