Тематическая лента
Подборка материалов
Публикации, объединённые общей практической задачей.
1920
материалов
01
Слой исполнения правил ИИ на JSON: как сделать поведение LLM наблюдаемым, а не просто промпт-инжиниринг
Практический wrapper для управления LLM через JSON-правила. Решает проблему наблюдаемости, сравнения моделей и контроля дрейфа поведения на 01.02.2026.
02
ChatLLM.cpp + Qwen3-ASR: Запустите распознавание и выравнивание речи локально без облаков
Пошаговый гайд по установке и запуску связки ChatLLM.cpp и Qwen3-ASR для локального распознавания и выравнивания аудио. Работает без интернета на CPU и GPU.
03
Nano Banana Pro: дизайн интерьера за 5 минут вместо 5 дней
Обзор Nano Banana Pro: как бесплатный ИИ-инструмент генерирует концепт-дизайн интерьеров за секунды. Примеры, сравнение с аналогами, инструкция.
04
MLX-Video и LTX-2: как запустить видео-модель на Mac и почему она весит 314 ГБ
Практический гайд по запуску LTX-2 через MLX-Video на Mac. Разбираемся, почему модель весит 314 ГБ и как её оптимизировать под Apple Silicon.
05
OLMo 3.5 Hybrid: как гибридная архитектура с линейным вниманием экономит память
Обзор OLMo 3.5 Hybrid: гибридная архитектура Gated Deltanet с линейным вниманием для работы с длинным контекстом при малых затратах памяти. Сравнение, примеры,
06
Falcon-H1-Tiny (90M): микро-модель, которая работает на чем угодно. Даже на холодильнике
Как запустить Falcon-H1-Tiny (90M) локально на слабом железе. Архитектура Mamba+Attention, Anti-curriculum обучение, интеграция с VS Code. Сравнение с Gemma 3 2
07
Новые короли без цензуры: GLM-4.7 Flash, GPT OSS и другие uncensored-модели на Hugging Face
Обзор самых актуальных uncensored моделей на Hugging Face на февраль 2026 года. GLM-4.7 Flash, GPT OSS, Gemma 3 и Qwen - прямые ссылки на GGUF-файлы, сравнение
08
Smolcluster: распределенный вывод LLM на Mac Mini и iPad — инструкция на 2026 год
Пошаговое руководство по настройке smolcluster для распределенного вывода LLM между Mac Mini M4 и iPad с A16 на Python в 2026 году.
09
Kakveda: когда ваш AI-агент начинает жаловаться до того, как сломается
Обзор Kakveda - open-source системы предупреждения ошибок для AI-агентов на Docker. Как работает failure intelligence и зачем она нужна в 2026 году.
10
PromptShrink: «беспощадное» сжатие промптов для локальных LLM без потери смысла
Полный обзор PromptShrink 2.1 — инструмента для агрессивного сжатия промптов. Как ускорить локальные модели, сэкономить память и снизить латентность. Актуальные
11
GoMCP: как заменить Python SDK от Anthropic и получить 100K tool calls/sec в production
GoMCP — production-grade сервер MCP на Go. Заменяет Python SDK, дает 100K вызовов в секунду, multi-tenancy, аудит. Полное руководство по миграции.
12
Multi Method RLHF Pipeline: как запустить 6 методов выравнивания ИИ в одном флаконе
Практическое руководство по запуску Multi Method RLHF Pipeline с 6 методами выравнивания ИИ. PPO, DPO, KTO, GRPO, RLVR и другие - все в одном open-source проект