Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

1920 материалов
01 Слой исполнения правил ИИ на JSON: как сделать поведение LLM наблюдаемым, а не просто промпт-инжиниринг Практический wrapper для управления LLM через JSON-правила. Решает проблему наблюдаемости, сравнения моделей и контроля дрейфа поведения на 01.02.2026. 7 мин чтения 02 ChatLLM.cpp + Qwen3-ASR: Запустите распознавание и выравнивание речи локально без облаков Пошаговый гайд по установке и запуску связки ChatLLM.cpp и Qwen3-ASR для локального распознавания и выравнивания аудио. Работает без интернета на CPU и GPU. 7 мин чтения 03 Nano Banana Pro: дизайн интерьера за 5 минут вместо 5 дней Обзор Nano Banana Pro: как бесплатный ИИ-инструмент генерирует концепт-дизайн интерьеров за секунды. Примеры, сравнение с аналогами, инструкция. 6 мин чтения 04 MLX-Video и LTX-2: как запустить видео-модель на Mac и почему она весит 314 ГБ Практический гайд по запуску LTX-2 через MLX-Video на Mac. Разбираемся, почему модель весит 314 ГБ и как её оптимизировать под Apple Silicon. 9 мин чтения 05 OLMo 3.5 Hybrid: как гибридная архитектура с линейным вниманием экономит память Обзор OLMo 3.5 Hybrid: гибридная архитектура Gated Deltanet с линейным вниманием для работы с длинным контекстом при малых затратах памяти. Сравнение, примеры, 7 мин чтения 06 Falcon-H1-Tiny (90M): микро-модель, которая работает на чем угодно. Даже на холодильнике Как запустить Falcon-H1-Tiny (90M) локально на слабом железе. Архитектура Mamba+Attention, Anti-curriculum обучение, интеграция с VS Code. Сравнение с Gemma 3 2 6 мин чтения 07 Новые короли без цензуры: GLM-4.7 Flash, GPT OSS и другие uncensored-модели на Hugging Face Обзор самых актуальных uncensored моделей на Hugging Face на февраль 2026 года. GLM-4.7 Flash, GPT OSS, Gemma 3 и Qwen - прямые ссылки на GGUF-файлы, сравнение 5 мин чтения 08 Smolcluster: распределенный вывод LLM на Mac Mini и iPad — инструкция на 2026 год Пошаговое руководство по настройке smolcluster для распределенного вывода LLM между Mac Mini M4 и iPad с A16 на Python в 2026 году. 6 мин чтения 09 Kakveda: когда ваш AI-агент начинает жаловаться до того, как сломается Обзор Kakveda - open-source системы предупреждения ошибок для AI-агентов на Docker. Как работает failure intelligence и зачем она нужна в 2026 году. 5 мин чтения 10 PromptShrink: «беспощадное» сжатие промптов для локальных LLM без потери смысла Полный обзор PromptShrink 2.1 — инструмента для агрессивного сжатия промптов. Как ускорить локальные модели, сэкономить память и снизить латентность. Актуальные 5 мин чтения 11 GoMCP: как заменить Python SDK от Anthropic и получить 100K tool calls/sec в production GoMCP — production-grade сервер MCP на Go. Заменяет Python SDK, дает 100K вызовов в секунду, multi-tenancy, аудит. Полное руководство по миграции. 6 мин чтения 12 Multi Method RLHF Pipeline: как запустить 6 методов выравнивания ИИ в одном флаконе Практическое руководство по запуску Multi Method RLHF Pipeline с 6 методами выравнивания ИИ. PPO, DPO, KTO, GRPO, RLVR и другие - все в одном open-source проект 8 мин чтения