Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
6277
GLM 4.7, MiniMax-M2.1 или DeepSeek 3.2: какую модель впихнуть в IDE в 2025
Технический разбор трёх лучших AI-ассистентов для кода: бенчмарки, практические тесты и рекомендации по выбору для Cline/Roo Code. Только актуальные данные на я
6278
Как запустить модель 14B на нескольких Jetson Orin Nano: распределённые вычисления с llama.cpp и RPC
Подробный гайд по запуску Qwen2.5-coder-14B на трёх Jetson Orin Nano через распределённый llama.cpp RPC-сервер. Архитектура, настройка сети, оптимизация произво
6279
Как собрать бюджетную AI-станцию на Ryzen с 128 ГБ ОЗУ: модели и сценарии для студентов
Пошаговое руководство по сборке AI-станции на Ryzen с 128 ГБ ОЗУ для локального запуска LLM, Whisper, TTS и vision-моделей. Спецификации, оптимизация, конкретны
6280
Drift в пайплайне AI-агента: как сократить 75% токенов на аудит кода
Пошаговое руководство по интеграции Drift в рабочий процесс AI-агента для автоматического получения контекста и сокращения 75% токенов на аудит кода.
6281
Практическое руководство по квантованию моделей Qwen-3-VL: AWQ, INT8 и инструменты для начинающих
Пошаговое руководство по квантованию Qwen-3-VL моделей. AWQ для embedding, INT8 для inference. Настройка под RTX 3090/6000 Pro. Инструменты и ошибки.
6282
MedGemma на практике: установка, запуск на RTX 4060 и тесты на медицинских данных
Пошаговый гайд по установке медицинской LLM MedGemma на RTX 4060. Тесты на реальных медицинских данных, сравнение с альтернативами и примеры использования.
6283
Зачем платить Tavily, если можно скрестить Bing с DuckDuckGo и получить свой поиск для RAG?
Обзор open-source инструмента для прямого веб-поиска в RAG без black-box API. Сравнение с Tavily, примеры использования и интеграция с Claude Desktop.
6284
Браузерный RAG для юристов: весь пайплайн в браузере, ноль утечек данных
Собираем полностью браузерный RAG-пайплайн на Phi-3.5 с WebGPU. MLC WebLLM, BGE-small, Tesseract.js, IndexedDB. Приватный анализ документов без серверов.
6285
4GB VRAM в браузере: Phi-3.5 против карликов. Кто выживет в WebLLM?
Сравнение производительности Phi-3.5 и миниатюрных LLM в браузере на 4GB видеопамяти. Тесты WebGPU, реальные цифры потребления VRAM, выбор модели для RAG.
6286
Loki-v2-70B: модель, которая заставит вас забыть про ChatGPT для ролевых игр
Полный разбор Loki-v2-70B - специализированной модели для ролевых игр и нарративов. Установка, квантование GGUF, сравнение с альтернативами на январь 2026.
6287
HashIndex: RAG без векторного поиска? Обзор новой альтернативы и интеграция с Ollama
HashIndex заменяет векторный поиск в RAG через hash map и однократный парсинг документов. Обзор открытой системы, сравнение с векторами и интеграция с Ollama.
6288
Loclean: ваша локальная кухня для очистки данных без облаков
Как использовать библиотеку loclean с GGUF-моделями для очистки и структурирования данных без облаков. Приватность, экономия, контроль.