Релиз llama.cpp b10087 добавляет нативную поддержку двух новых моделей от компании Laguna - сверхлёгкой XS.2 и сбалансированной M.1. Это прямое расширение экосистемы фреймворка, которое даёт разработчикам и ML-инженерам новые инструменты для локального запуска LLM без облачных зависимостей. Обе модели уже доступны в формате GGUF и оптимизированы под эффективный инференс на CPU и GPU.
Обновление продолжает стратегию проекта по интеграции перспективных архитектур. Если вы работаете с Poolside Laguna-S-2.1, то XS.2 и M.1 закрывают нишу более компактных решений для edge-устройств и повседневных задач на локальных машинах. Разберём, что именно изменилось, как запустить новые модели и какие метрики производительности они показывают.