Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

6277 GLM 4.7, MiniMax-M2.1 или DeepSeek 3.2: какую модель впихнуть в IDE в 2025 Технический разбор трёх лучших AI-ассистентов для кода: бенчмарки, практические тесты и рекомендации по выбору для Cline/Roo Code. Только актуальные данные на я 8 мин чтения 6278 Как запустить модель 14B на нескольких Jetson Orin Nano: распределённые вычисления с llama.cpp и RPC Подробный гайд по запуску Qwen2.5-coder-14B на трёх Jetson Orin Nano через распределённый llama.cpp RPC-сервер. Архитектура, настройка сети, оптимизация произво 9 мин чтения 6279 Как собрать бюджетную AI-станцию на Ryzen с 128 ГБ ОЗУ: модели и сценарии для студентов Пошаговое руководство по сборке AI-станции на Ryzen с 128 ГБ ОЗУ для локального запуска LLM, Whisper, TTS и vision-моделей. Спецификации, оптимизация, конкретны 12 мин чтения 6280 Drift в пайплайне AI-агента: как сократить 75% токенов на аудит кода Пошаговое руководство по интеграции Drift в рабочий процесс AI-агента для автоматического получения контекста и сокращения 75% токенов на аудит кода. 7 мин чтения 6281 Практическое руководство по квантованию моделей Qwen-3-VL: AWQ, INT8 и инструменты для начинающих Пошаговое руководство по квантованию Qwen-3-VL моделей. AWQ для embedding, INT8 для inference. Настройка под RTX 3090/6000 Pro. Инструменты и ошибки. 10 мин чтения 6282 MedGemma на практике: установка, запуск на RTX 4060 и тесты на медицинских данных Пошаговый гайд по установке медицинской LLM MedGemma на RTX 4060. Тесты на реальных медицинских данных, сравнение с альтернативами и примеры использования. 8 мин чтения 6283 Зачем платить Tavily, если можно скрестить Bing с DuckDuckGo и получить свой поиск для RAG? Обзор open-source инструмента для прямого веб-поиска в RAG без black-box API. Сравнение с Tavily, примеры использования и интеграция с Claude Desktop. 6 мин чтения 6284 Браузерный RAG для юристов: весь пайплайн в браузере, ноль утечек данных Собираем полностью браузерный RAG-пайплайн на Phi-3.5 с WebGPU. MLC WebLLM, BGE-small, Tesseract.js, IndexedDB. Приватный анализ документов без серверов. 10 мин чтения 6285 4GB VRAM в браузере: Phi-3.5 против карликов. Кто выживет в WebLLM? Сравнение производительности Phi-3.5 и миниатюрных LLM в браузере на 4GB видеопамяти. Тесты WebGPU, реальные цифры потребления VRAM, выбор модели для RAG. 7 мин чтения 6286 Loki-v2-70B: модель, которая заставит вас забыть про ChatGPT для ролевых игр Полный разбор Loki-v2-70B - специализированной модели для ролевых игр и нарративов. Установка, квантование GGUF, сравнение с альтернативами на январь 2026. 8 мин чтения 6287 HashIndex: RAG без векторного поиска? Обзор новой альтернативы и интеграция с Ollama HashIndex заменяет векторный поиск в RAG через hash map и однократный парсинг документов. Обзор открытой системы, сравнение с векторами и интеграция с Ollama. 6 мин чтения 6288 Loclean: ваша локальная кухня для очистки данных без облаков Как использовать библиотеку loclean с GGUF-моделями для очистки и структурирования данных без облаков. Приватность, экономия, контроль. 5 мин чтения