Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
3637
Skills и CLI для coding agents: как LangChain улучшил производительность Claude Code до 95%
LangChain выпустил skills и CLI для LangSmith, которые подняли производительность Claude Code с 29% до 95%. Обзор новых инструментов и сравнение с альтернативам
3638
GestaltSyntax - семантический пресс для старого кода: как впихнуть FORTRAN в контекстное окно AI
Открытый инструмент GestaltSyntax сжимает legacy-код до 12 раз для перевода AI-моделями. Возможности, сравнение с альтернативами, примеры использования.
3639
Как решить проблему загрузки Qwen3.5 35B EXL3 квантов в text-generation-webui: пошаговое руководство
Пошаговое руководство по решению проблем с загрузкой Qwen3.5 35B EXL3 квантов в text-generation-webui. Обновления на 2026 год, настройка exllamav3, исправление
3640
Cicikus v3 Prometheus 4.4B: тестируем экспериментальную модель для логических задач на слабом железе
Тестируем экспериментальную модель Cicikus v3 Prometheus 4.4B для логических задач. Franken-merge, сравнение с Llama 3.2 и Gemma 3, примеры использования на сла
3641
Ускорение vLLM на Jetson Orin в 3.8 раза: установка pre-built wheel с Marlin GPTQ
Готовый wheel для vLLM с поддержкой Marlin GPTQ ускоряет вывод LLM на Jetson Orin в 3.8 раза. Установка, бенчмарки, сравнение.
3642
Патч CUTLASS и настройки для ускорения Qwen3.5-397B в 5 раз на Blackwell GPU (до 282 токенов/с)
Экстремальная оптимизация Qwen3.5-397B MoE. Кастомное ядро, патч SM120, Docker-образ. 282 токена/с на Blackwell. Гайд по установке.
3643
Методы чанкинга для STT: как разбивать длинные аудио без потери точности транскрипции
Как разбивать длинные аудиофайлы для распознавания речи. Практическое руководство по чанкингу с Silero VAD, диаризацией и перекрывающимися чанками. Примеры кода
3644
ASI: локальный AI-ассистент для Android, который понимает прикосновения
Обзор open-source проекта ASI: локальный AI-ассистент для Android с сенсорным восприятием на базе Gemma 3. Работает без интернета, полностью приватно.
3645
Reprompt: ваш промпт останется в семье
Как анализировать и оценивать промпты для AI-кодинга локально с помощью Reprompt. TF-IDF, Ollama и полная приватность данных. Установка и примеры.
3646
Квантование MoE-моделей: опыт с Qwen3-Coder-Next и высококачественными GGUF
Экспертный разбор квантования MoE-моделей на примере Qwen3-Coder-Next. Технические детали по Q8_0, оффлоаду экспертов и созданию высококачественных GGUF файлов
3647
Mistral Small 3 (14B) против 30B моделей: разбор масштабного теста 135 локальных LLM
Mistral Small 3 (14B) обгоняет 30B модели в тесте 135 локальных LLM. Анализ результатов и практические выводы для выбора оптимальной модели на 2026 год.
3648
Макбук M4 Max задыхается на Qwen: как заставить LM Studio летать с контекстом 80k
Полный гайд по ускорению обработки промптов в LM Studio на M4 Max. Решаем проблемы с Qwen, оптимизируем переменные среды, настраиваем Metal API.