Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
5869
Локальный мультимодальный ассистент на Android: как собрать стек из Gemma 3N, RAG и TTS для работы оффлайн
Пошаговый гайд по сборке локального мультимодального ассистента на Android с Gemma 3N, RAG и TTS. Работает полностью оффлайн, не требует интернета.
5870
Gitnexus: как opensource-инструмент создаёт граф знаний кодовой базы для улучшения RAG и работы LLM
Обзор Gitnexus - opensource инструмента для создания графа знаний кодовой базы. Как улучшает RAG, сравнение с альтернативами, примеры использования и кому подой
5871
Оптимизация Kimi 2.5 на vLLM: как выжать 1500 TPS из кластера на 8xRTX 6000 Blackwell
Пошаговый гайд по настройке tensor-parallel для Kimi 2.5 на vLLM. Увеличиваем TPS до 1500 на кластере из 8 RTX 6000 Blackwell.
5872
OpenClaw и Moltbook: как персональные ИИ-ассистенты создают свою собственную социальную сеть
Как проект OpenClaw пережил конфликт с Anthropic и создал Moltbook — первую социальную сеть, где общаются только ИИ-ассистенты. Роль Андрея Карпати и будущее пе
5873
GPT-OSS 120B: старый добрый монстр, который до сих пор рвет всех в локальном запуске
Архитектура A3B, нативное 4-битное обучение и 120 млрд параметров. Почему GPT-OSS 120B до сих пор быстрее и качественнее новых моделей на домашнем железе.
5874
Kimi K2.5: бенчмарк производительности на железе энтузиастов — Epyc, RTX PRO 6000, SGLang
Подробный бенчмарк Kimi K2.5 на Epyc 9374F и RTX PRO 6000: 497 t/s prefill, сравнение SGLang и vLLM, настройка llmperf-rs. Актуально на январь 2026.
5875
GGUF-файлы Kimi-K2.5 весят больше INT4: парадокс или техническая необходимость?
Глубокий анализ форматов квантования Kimi-K2.5. Почему GGUF весит больше INT4, как получить полную точность при размере <600 ГБ. Решение проблемы.
5876
Кризис r/LocalLLaMA: как сообщество борется со спамом от недоделанных AI-агентов и проектов
Как сообщество r/LocalLLaMA борется со спамом от недоделанных AI-агентов. Анализ ситуации, методы модерации и прогнозы на 31.01.2026.
5877
Moltbook: первая соцсеть для ИИ-агентов. И почему её уже ненавидят в OpenAI
Как работает первая соцсеть для AI-агентов Moltbook с 32 тыс. пользователей, какие угрозы безопасности она несёт и почему OpenClaw её уже блокирует.
5878
Многопользовательский AI-чат с голосами: локальный прорыв 2026 года
Как запустить многопользовательский AI-чат с уникальными голосами локально. Обзор технологий, сравнение альтернатив и пошаговая настройка на потребительском жел
5879
Когда SQL и векторный поиск дерутся за ваши данные: архитектура локального RAG-пайплайна
Пошаговый гайд по созданию локального RAG-пайплайна, объединяющего текстовый SQL и векторный поиск. Архитектура, инструменты, код на 2026 год.
5880
Кладем Claude Code на полку: бесплатный стэк с NVIDIA NIM и Telegram-клиентом
Как заменить Claude Code на бесплатный стэк с NVIDIA NIM API, Telegram-ботом и локальным прокси. Экономия денег, полный контроль над моделями.