Тематическая лента
Подборка материалов
Публикации, объединённые общей практической задачей.
1920
материалов
01
SeeQL: Как построить open-source интерфейс для общения с SQL-базой на естественном языке
Обзор SeeQL — локального интерфейса для запросов к SQL на русском языке. Технологии OpenUI Lang, MCP server и современные LLM. Установка и примеры.
02
Как управлять поведением LLM через активации: патч llama-server и Sparse Autoencoders
Полный разбор управления поведением Llama и Mistral через низкоуровневые активации. Патч для llama-server и Sparse Autoencoders для контроля сикофансии и креати
03
Qwen 3.5 397B на Mac: рекорд 93% на MMLU и квантование для MLX
Анонс Qwen 3.5 397B с рекордом 93% на MMLU. Квантование для MLX позволяет запустить гигантскую модель на Mac с Apple Silicon. Обзор, сравнение и примеры использ
04
TextRM-28M: тестируем крошечную модель для бизнес-писем с кодом на GitHub
Обзор TextRM-28M - модели на 28 миллионов параметров для генерации бизнес-писем. Тестируем возможности, сравниваем с альтернативами, примеры кода на Python.
05
LiteParse от LlamaIndex: локальный парсинг документов через CLI без облаков
Обзор LiteParse от LlamaIndex - open-source CLI для локального парсинга документов. Установка, примеры команд, сравнение с облачным LlamaParse. Анализ возможнос
06
Субсекундный запуск 32B моделей: технология восстановления состояния для мгновенной загрузки ИИ
Обзор технологии восстановления состояния GPU для запуска 32B моделей за секунды. Как работает, сравнение с альтернативами и практическое применение локально в
07
QwenDean-4B: Ваш локальный v0-dev за 4 миллиарда параметров
Практический разбор QwenDean-4B - fine-tuned Qwen3-4B для генерации интерфейсов как v0.dev. Возможности, сравнение, примеры использования и кому подойдет.
08
Обзор PearlOS: как запустить рой интеллектуальных агентов на своём ПК с локальным TTS
Обзор PearlOS - ОС для интеллектуальных агентов с поддержкой локальных моделей и TTS. Установка, примеры, сравнение с аналогами на 2026 год.
09
Widemem: open-source память для агентов с оценкой достоверности, чтобы ИИ говорил «Не знаю»
Обзор Widemem — open-source библиотеки для борьбы с галлюцинациями AI-агентов. Векторный поиск с SQLite, оценка confidence score, интеграция с Ollama. Установка
10
acestep.cpp: как установить и использовать портируемую реализацию ACE-Step 1.5 для генерации музыки на GGML
Пошаговое руководство по установке и использованию acestep.cpp — портируемой реализации ACE-Step 1.5 для локальной генерации музыки на CPU, CUDA и Metal.
11
Nemotron-3-Super-120B дистиллирована от Claude 4.6: когда 120 миллиардов параметров помещаются в ваш ноутбук
Практический обзор дистиллированной Nemotron-3-Super-120B от Claude 4.6. Сравнение форматов BF16, FP8, GGUF и инструкция по локальному запуску мощной модели.
12
SPEED-Bench: когда спекулятивное декодирование перестает быть магией и становится цифрами
Полный обзор SPEED-Bench — нового стандарта для оценки скорости спекулятивного декодирования в больших языковых моделях. Примеры использования и сравнения.