Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

7057 Безоблачный AI в игре: как запустить локальную Llama 3.1 на 6 ГБ VRAM через Tauri Практический гайд по интеграции Llama 3.1 в desktop-приложения через Tauri. Оптимизация под 6 ГБ VRAM, настройка llama-server с Vulkan, выбор Q4_K_M квантования 9 мин чтения 7058 Claude Code на Mac M3: как заменить облако локальными моделями и не сойти с ума Полный гайд по замене Claude Code локальными моделями на Mac M3 Pro. Обзор кодинг-агентов, терминальных инструментов и оптимизация под Swift/Xcode разработку. 9 мин чтения 7059 Квантование vs размер модели: почему 4-битная Llama 3 405B обгоняет FP16 70B в сложных рассуждениях Парадокс квантования: 4-битная Llama 3 405B побеждает полноточную 70B в сложных рассуждениях. Разбираем бенчмарки LSAT, механику мышления и выбор между размером 7 мин чтения 7060 Почему AI-агенты ломаются в продакшене: анализ проблем с состоянием, сайд-эффектами и аудитом Глубокий разбор, почему AI-агенты ломаются в реальных системах. Анализ проблем с многошаговыми workflow, сайд-эффектами, состоянием и аудитом. Практические реше 9 мин чтения 7061 RTX 6000 Pro (Blackwell) не POSTится на MSI Z790-P: решение проблемы совместимости RTX 6000 Pro (Blackwell) не запускается на MSI Z790-P? Пошаговое решение через обновление BIOS, настройку PCIe и UEFI. Совместимость материнских плат для AI-раб 8 мин чтения 7062 Seline v0.1.4: локальный AI-агент обзавелся Codex и умным поиском Локальный AI-агент Seline v0.1.4 получил поддержку OpenAI Codex OAuth, гибридный векторный поиск и мастер настройки. Обзор возможностей и туториал. 4 мин чтения 7063 BMO на Raspberry Pi 5: как я собрал AI-компаньона с Mistral и зрением за 300$ Пошаговый обзор проекта BMO - голосового AI-компаньона на Raspberry Pi 5 с Mistral, OpenAI API и компьютерным зрением YOLO11n. Код на GitHub. 5 мин чтения 7064 Google AI в центре скандала: как протокол покупок превратил чат-ботов в продавцов-навязчив Раскрываем детали скандала вокруг Google Universal Commerce Protocol. Как AI-агенты завышают цены, собирают данные чатов и что об этом думают регуляторы. 4 мин чтения 7065 Как оценивать качество LLM-продукта: практическое руководство с датасетом и калибровкой Практическое руководство по оценке качества LLM-продуктов. Разметка датасета, калибровка оценщиков, бинарные метки vs сравнения. Методология для инженеров и про 7 мин чтения 7066 Как тестировать LLM-приложения: практическое руководство по DeepEval с кодом и примерами Полное руководство по тестированию LLM-приложений с DeepEval. LLM-as-a-judge, семантическое тестирование, оценка качества. Код, примеры, лучшие практики. 10 мин чтения 7067 LFM 2.5 1.2B: языковая модель, которая обгоняет мысль Обзор модели LFM 2.5 1.2B: 578 токенов в секунду на десктопе, потенциал для Raspberry Pi, сравнение с альтернативами и примеры использования. 5 мин чтения 7068 Veo 3.1 Ingredients to Video: полный гайд по превращению картинок в кино через Gemini API Пошаговый гайд по использованию Veo 3.1 для генерации видео из изображений через Gemini API и Vertex AI. Код, промпты, консистентность персонажей. 8 мин чтения