Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

1920 материалов
01 Чистый Python вместо LLM: как собрать связанную вики из заметок без единого запроса к нейросети Пошаговый гайд по сборке связанной вики из Markdown-заметок на чистом Python без API нейросетей. Регулярки, графы ссылок, бенчмарки и полный код. 6 мин чтения 02 Запуск Gemma 4 12B на Mac с MLX: открытый проект Helios Проект Helios — оптимизированный запуск Gemma 4 12B на Mac через MLX. Сравнение с llama.cpp, примеры кода, тесты скорости на M5. Бесплатно и открыто. 5 мин чтения 03 Prompt Warrior: геймифицированный самоанализ логов Claude Code — инструкция по установке и использованию Prompt Warrior — open-source инструмент для геймифицированного анализа логов Claude Code. Достижения, психологический профиль агента, локальная установка. Инстр 6 мин чтения 04 119B параметров, но мозгов — на 6B: честный тест Mistral Leanstral 1.5 и его запуск у вас дома Разбираем Mistral Leanstral 1.5 — MoE-модель 119B с 6B активных параметров. Сравнение с DeepSeek V3.2 и Qwen3. Как запустить на домашнем сервере, квантование, р 1 мин чтения 05 Детерминированный RAG: инструмент памяти с recall 1.0 без вызовов LLM — разбор подхода Разбор подхода к RAG, который дает 100% recall и не требует обращения к языковой модели. Как работает, где применить и почему это дешевле традиционных решений. 5 мин чтения 06 Домашний сервер для LLM на 6x P40: запуск Minimax M2.7 с квантованием Q3_XL Подробный гайд по сборке дешёвого сервера из шести NVIDIA P40 (144 ГБ VRAM) для запуска больших языковых моделей. На примере Minimax M2.7 с квантованием Q3_XL — 5 мин чтения 07 OpenLumara Harness: токен-эффективная упряжка с OpenAI-мостом для локальных LLM Обзор OpenLumara — супер-токен-эффективного инструмента с OpenAI Bridge для локальных моделей. Сравнение с альтернативами, примеры, кому подойдёт. 4 мин чтения 08 Первое независимое тестирование 1-битной модели Bonsai-8B для вызова инструментов на CPU: победа над IBM Granite при грамматически ограниченной декодировке Независимый бенчмарк 1-битной Bonsai-8B для tool calling на CPU: грамматическая декодировка через llama.cpp. Bonsai-8B опередила IBM Granite в точности вызова и 5 мин чтения 09 Meta-Spider: мета-внимание для контроля поведения LLM — разбор новых компонентов Глубокий технический обзор фреймворка Meta-Spider с новыми компонентами: ручка неуверенности, сторож и фабрика обвязок. Как это решает дрейф цели и что дает раз 5 мин чтения 10 Создаем локальный бэкенд для NPC с диалогами NPC-NPC на базе LLM Как создать бэкенд для диалогов между NPC с помощью локальной LLM. Код, примеры, сравнение с альтернативами. Для разработчиков игр. 7 мин чтения 11 Ornith 35B FP8: локальный монстр кодинга, который не просит интернета Разбираем Ornith 35B FP8 — локальную модель для кодинга с MTP speculative decode. Сравнение с Qwen, DeepSeek, тесты на RTX 4090 и 3090. Кому реально нужно? 5 мин чтения 12 Claude Sonnet 5: агентный апгрейд, цены и как использовать в API и Claude Code Разбираем Claude Sonnet 5: агентные способности, цены API, примеры использования в Claude Code. Сравнение с GPT-4o и Gemini 2.0. Кому подойдет. 7 мин чтения