Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

3637 Skills и CLI для coding agents: как LangChain улучшил производительность Claude Code до 95% LangChain выпустил skills и CLI для LangSmith, которые подняли производительность Claude Code с 29% до 95%. Обзор новых инструментов и сравнение с альтернативам 4 мин чтения 3638 GestaltSyntax - семантический пресс для старого кода: как впихнуть FORTRAN в контекстное окно AI Открытый инструмент GestaltSyntax сжимает legacy-код до 12 раз для перевода AI-моделями. Возможности, сравнение с альтернативами, примеры использования. 6 мин чтения 3639 Как решить проблему загрузки Qwen3.5 35B EXL3 квантов в text-generation-webui: пошаговое руководство Пошаговое руководство по решению проблем с загрузкой Qwen3.5 35B EXL3 квантов в text-generation-webui. Обновления на 2026 год, настройка exllamav3, исправление 7 мин чтения 3640 Cicikus v3 Prometheus 4.4B: тестируем экспериментальную модель для логических задач на слабом железе Тестируем экспериментальную модель Cicikus v3 Prometheus 4.4B для логических задач. Franken-merge, сравнение с Llama 3.2 и Gemma 3, примеры использования на сла 5 мин чтения 3641 Ускорение vLLM на Jetson Orin в 3.8 раза: установка pre-built wheel с Marlin GPTQ Готовый wheel для vLLM с поддержкой Marlin GPTQ ускоряет вывод LLM на Jetson Orin в 3.8 раза. Установка, бенчмарки, сравнение. 5 мин чтения 3642 Патч CUTLASS и настройки для ускорения Qwen3.5-397B в 5 раз на Blackwell GPU (до 282 токенов/с) Экстремальная оптимизация Qwen3.5-397B MoE. Кастомное ядро, патч SM120, Docker-образ. 282 токена/с на Blackwell. Гайд по установке. 6 мин чтения 3643 Методы чанкинга для STT: как разбивать длинные аудио без потери точности транскрипции Как разбивать длинные аудиофайлы для распознавания речи. Практическое руководство по чанкингу с Silero VAD, диаризацией и перекрывающимися чанками. Примеры кода 7 мин чтения 3644 ASI: локальный AI-ассистент для Android, который понимает прикосновения Обзор open-source проекта ASI: локальный AI-ассистент для Android с сенсорным восприятием на базе Gemma 3. Работает без интернета, полностью приватно. 7 мин чтения 3645 Reprompt: ваш промпт останется в семье Как анализировать и оценивать промпты для AI-кодинга локально с помощью Reprompt. TF-IDF, Ollama и полная приватность данных. Установка и примеры. 5 мин чтения 3646 Квантование MoE-моделей: опыт с Qwen3-Coder-Next и высококачественными GGUF Экспертный разбор квантования MoE-моделей на примере Qwen3-Coder-Next. Технические детали по Q8_0, оффлоаду экспертов и созданию высококачественных GGUF файлов 8 мин чтения 3647 Mistral Small 3 (14B) против 30B моделей: разбор масштабного теста 135 локальных LLM Mistral Small 3 (14B) обгоняет 30B модели в тесте 135 локальных LLM. Анализ результатов и практические выводы для выбора оптимальной модели на 2026 год. 6 мин чтения 3648 Макбук M4 Max задыхается на Qwen: как заставить LM Studio летать с контекстом 80k Полный гайд по ускорению обработки промптов в LM Studio на M4 Max. Решаем проблемы с Qwen, оптимизируем переменные среды, настраиваем Metal API. 6 мин чтения