Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

5869 Локальный мультимодальный ассистент на Android: как собрать стек из Gemma 3N, RAG и TTS для работы оффлайн Пошаговый гайд по сборке локального мультимодального ассистента на Android с Gemma 3N, RAG и TTS. Работает полностью оффлайн, не требует интернета. 9 мин чтения 5870 Gitnexus: как opensource-инструмент создаёт граф знаний кодовой базы для улучшения RAG и работы LLM Обзор Gitnexus - opensource инструмента для создания графа знаний кодовой базы. Как улучшает RAG, сравнение с альтернативами, примеры использования и кому подой 8 мин чтения 5871 Оптимизация Kimi 2.5 на vLLM: как выжать 1500 TPS из кластера на 8xRTX 6000 Blackwell Пошаговый гайд по настройке tensor-parallel для Kimi 2.5 на vLLM. Увеличиваем TPS до 1500 на кластере из 8 RTX 6000 Blackwell. 8 мин чтения 5872 OpenClaw и Moltbook: как персональные ИИ-ассистенты создают свою собственную социальную сеть Как проект OpenClaw пережил конфликт с Anthropic и создал Moltbook — первую социальную сеть, где общаются только ИИ-ассистенты. Роль Андрея Карпати и будущее пе 7 мин чтения 5873 GPT-OSS 120B: старый добрый монстр, который до сих пор рвет всех в локальном запуске Архитектура A3B, нативное 4-битное обучение и 120 млрд параметров. Почему GPT-OSS 120B до сих пор быстрее и качественнее новых моделей на домашнем железе. 6 мин чтения 5874 Kimi K2.5: бенчмарк производительности на железе энтузиастов — Epyc, RTX PRO 6000, SGLang Подробный бенчмарк Kimi K2.5 на Epyc 9374F и RTX PRO 6000: 497 t/s prefill, сравнение SGLang и vLLM, настройка llmperf-rs. Актуально на январь 2026. 9 мин чтения 5875 GGUF-файлы Kimi-K2.5 весят больше INT4: парадокс или техническая необходимость? Глубокий анализ форматов квантования Kimi-K2.5. Почему GGUF весит больше INT4, как получить полную точность при размере <600 ГБ. Решение проблемы. 7 мин чтения 5876 Кризис r/LocalLLaMA: как сообщество борется со спамом от недоделанных AI-агентов и проектов Как сообщество r/LocalLLaMA борется со спамом от недоделанных AI-агентов. Анализ ситуации, методы модерации и прогнозы на 31.01.2026. 2 мин чтения 5877 Moltbook: первая соцсеть для ИИ-агентов. И почему её уже ненавидят в OpenAI Как работает первая соцсеть для AI-агентов Moltbook с 32 тыс. пользователей, какие угрозы безопасности она несёт и почему OpenClaw её уже блокирует. 4 мин чтения 5878 Многопользовательский AI-чат с голосами: локальный прорыв 2026 года Как запустить многопользовательский AI-чат с уникальными голосами локально. Обзор технологий, сравнение альтернатив и пошаговая настройка на потребительском жел 8 мин чтения 5879 Когда SQL и векторный поиск дерутся за ваши данные: архитектура локального RAG-пайплайна Пошаговый гайд по созданию локального RAG-пайплайна, объединяющего текстовый SQL и векторный поиск. Архитектура, инструменты, код на 2026 год. 9 мин чтения 5880 Кладем Claude Code на полку: бесплатный стэк с NVIDIA NIM и Telegram-клиентом Как заменить Claude Code на бесплатный стэк с NVIDIA NIM API, Telegram-ботом и локальным прокси. Экономия денег, полный контроль над моделями. 7 мин чтения