Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

5137 MCP в llama.cpp: от экспериментальной фичи до полноценного агента Полный гайд по интеграции Model Context Protocol в llama.cpp. Установка, настройка CORS Proxy, Tool Calls, System Message injection и создание автономных агенто 6 мин чтения 5138 Кризис в xAI: почему уходит половина основателей и что это значит для Grok и будущего компании Почему 5 из 12 основателей xAI ушли от Илона Маска? Анализ кадрового кризиса, проблем с Grok и будущего компании перед IPO в 2026 году. 5 мин чтения 5139 Mindstream: как я собрал RSS-ленту, которая читает за меня (и не врет) Пошаговый гайд по сборке AI-приложения для фильтрации RSS с помощью языковых моделей. Полный код на GitHub, работа с Habr и другими источниками. 9 мин чтения 5140 Aratta: суверенный слой для AI-провайдеров, который не сломается, когда OpenAI упадет Обзор Aratta - open-source решения для создания отказоустойчивого AI-слоя с локальными моделями и резервным облаком. Архитектура, сравнение с LiteLLM, примеры. 7 мин чтения 5141 Qwen3 Next — MoE-модель нового поколения: требования к железу и перспективы для Mac Полный разбор Qwen3 Next MoE-модели: требования к памяти на Mac, сравнение с Qwen2.5, оптимизация под Apple Silicon и практические тесты на февраль 2026 года. 6 мин чтения 5142 MemV: память для AI-агентов, которая учится на ошибках предсказаний Установка и использование MemV — open-source памяти для AI-агентов с predict-calibrate extraction. Би-временная модель, гибридный поиск RRF, борьба с зашумлённо 8 мин чтения 5143 Два мозга лучше одного: как собрать AI-ассистента с роутером и мозгом на ограниченных ресурсах Пошаговое руководство по созданию кастомного AI-ассистента с двумя моделями: роутер для определения интента и мозг для ответов. Экономия GPU, серийная загрузка, 9 мин чтения 5144 MLX Omni Engine: как запускать аудио- и эмбеддинг-модели на Apple Silicon вместо GGUF Обзор MLX Omni Engine для локального запуска аудио и эмбеддинг-моделей на Mac. Сравнение с Ollama, установка и примеры использования. 8 мин чтения 5145 Amazon Nova Sonic: как одна модель убила каскадную архитектуру голосовых ассистентов Новая архитектура Nova Sonic от Amazon перевернула голосовые ассистенты. End-to-end модель против каскадных систем - подробный разбор. 6 мин чтения 5146 Гроккинг при тонкой настройке LLM: миф или реальность? Практические наблюдения Разбираем феномен гроккинга при тонкой настройке языковых моделей. Актуальные исследования, практические наблюдения и методы управления обучением на 2026 год. 8 мин чтения 5147 Ktop: один терминал вместо двух, или как следить за локальной LLM без шизофрении Обзор Ktop — гибридного монитора для CPU и GPU, который заменяет btop и nvtop при работе с локальными LLM. Установка, настройка, сравнение. 6 мин чтения 5148 NanoQuant: когда 0.75 бита на вес — это не шутка, а реальность Технический обзор NanoQuant — метода квантования ниже 1 бита на вес. Сравнение с GPTQ, примеры использования и кому подойдет экстремальное сжатие моделей в 2026 5 мин чтения