Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

1920 материалов
01 SeeQL: Как построить open-source интерфейс для общения с SQL-базой на естественном языке Обзор SeeQL — локального интерфейса для запросов к SQL на русском языке. Технологии OpenUI Lang, MCP server и современные LLM. Установка и примеры. 5 мин чтения 02 Как управлять поведением LLM через активации: патч llama-server и Sparse Autoencoders Полный разбор управления поведением Llama и Mistral через низкоуровневые активации. Патч для llama-server и Sparse Autoencoders для контроля сикофансии и креати 6 мин чтения 03 Qwen 3.5 397B на Mac: рекорд 93% на MMLU и квантование для MLX Анонс Qwen 3.5 397B с рекордом 93% на MMLU. Квантование для MLX позволяет запустить гигантскую модель на Mac с Apple Silicon. Обзор, сравнение и примеры использ 4 мин чтения 04 TextRM-28M: тестируем крошечную модель для бизнес-писем с кодом на GitHub Обзор TextRM-28M - модели на 28 миллионов параметров для генерации бизнес-писем. Тестируем возможности, сравниваем с альтернативами, примеры кода на Python. 3 мин чтения 05 LiteParse от LlamaIndex: локальный парсинг документов через CLI без облаков Обзор LiteParse от LlamaIndex - open-source CLI для локального парсинга документов. Установка, примеры команд, сравнение с облачным LlamaParse. Анализ возможнос 5 мин чтения 06 Субсекундный запуск 32B моделей: технология восстановления состояния для мгновенной загрузки ИИ Обзор технологии восстановления состояния GPU для запуска 32B моделей за секунды. Как работает, сравнение с альтернативами и практическое применение локально в 5 мин чтения 07 QwenDean-4B: Ваш локальный v0-dev за 4 миллиарда параметров Практический разбор QwenDean-4B - fine-tuned Qwen3-4B для генерации интерфейсов как v0.dev. Возможности, сравнение, примеры использования и кому подойдет. 5 мин чтения 08 Обзор PearlOS: как запустить рой интеллектуальных агентов на своём ПК с локальным TTS Обзор PearlOS - ОС для интеллектуальных агентов с поддержкой локальных моделей и TTS. Установка, примеры, сравнение с аналогами на 2026 год. 5 мин чтения 09 Widemem: open-source память для агентов с оценкой достоверности, чтобы ИИ говорил «Не знаю» Обзор Widemem — open-source библиотеки для борьбы с галлюцинациями AI-агентов. Векторный поиск с SQLite, оценка confidence score, интеграция с Ollama. Установка 5 мин чтения 10 acestep.cpp: как установить и использовать портируемую реализацию ACE-Step 1.5 для генерации музыки на GGML Пошаговое руководство по установке и использованию acestep.cpp — портируемой реализации ACE-Step 1.5 для локальной генерации музыки на CPU, CUDA и Metal. 6 мин чтения 11 Nemotron-3-Super-120B дистиллирована от Claude 4.6: когда 120 миллиардов параметров помещаются в ваш ноутбук Практический обзор дистиллированной Nemotron-3-Super-120B от Claude 4.6. Сравнение форматов BF16, FP8, GGUF и инструкция по локальному запуску мощной модели. 5 мин чтения 12 SPEED-Bench: когда спекулятивное декодирование перестает быть магией и становится цифрами Полный обзор SPEED-Bench — нового стандарта для оценки скорости спекулятивного декодирования в больших языковых моделях. Примеры использования и сравнения. 5 мин чтения