Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

7789 Как выбрать самый дешёвый GPU-провайдер для запуска своей модели: сравнение Hyperstack, Runpod и облачных хранилищ Практическое руководство по выбору самого дешёвого GPU для LLM. Сравнение цен Hyperstack и Runpod, оптимизация хранения в Cloudflare R2, Wasabi, AWS S3. Пошагов 8 мин чтения 7790 Дешёвый AI-инференс: как они это делают и почему вам стоит волноваться Разбираемся, как работают дешёвые облачные AI-сервисы. Технические оптимизации, бизнес-модели и скрытые риски, о которых молчат провайдеры. 7 мин чтения 7791 DGX OS умер, да здравствует Ubuntu: как вырвать телеметрию NVIDIA и заставить железо работать на LLM Полный гайд по замене DGX OS на Ubuntu для Spark/DGX. Удаляем телеметрию NVIDIA, настраиваем железо для локальных LLM, отключаем интернет-зависимость. 8 мин чтения 7792 Полное руководство: от обучения LLM с нуля до публикации на Hugging Face Пошаговый гайд по обучению языковых моделей с нуля, оценке качества и публикации на Hugging Face Hub. От данных до продакшена. 8 мин чтения 7793 Lynkr: ваш личный диспетчер для 15+ LLM, который экономит деньги и нервы Обзор Lynkr — open-source прокси для интеллектуальной маршрутизации запросов между 15+ LLM провайдерами, включая локальные модели Ollama. Экономит до 70% на API 7 мин чтения 7794 LM Studio на Mac M5: Когда Metal API сходит с ума и модель падает с Exit code 6 Полное решение ошибок LM Studio на Mac с M5 чипом: 'model crashed', 'Metal API kernel loading', Exit code 6. Пошаговый гайд с настройками GGUF моделей и сравнен 7 мин чтения 7795 Создаем аудиокнигу на ноутбуке с удаленным GPU: Docker, XTTS и немного магии Пошаговый туториал по созданию аудиокниг на своем компьютере с использованием Docker, XTTS модели и удаленного GPU через SSH. Без облаков, без подписок. 13 мин чтения 7796 Когда MCP отвечают как бабушки в очереди: как mcp-context-proxy режет болтовню Обзор инструмента для сжатия ответов Model Context Protocol. Экономим токены, ускоряем работу локальных LLM. Установка, настройка, сравнение с альтернативами. 6 мин чтения 7797 T-Scan: Практическое руководство по визуализации внутренних активаций трансформеров Пошаговое руководство по T-Scan - инструменту для визуализации внутренних активаций трансформеров. Установка, примеры использования, сравнение с альтернативами. 6 мин чтения 7798 Эффект Манделы в ИИ: Почему галлюцинации LLM — это не баг, а фундаментальное свойство архитектуры Глубокий анализ почему галлюцинации в LLM — это не ошибка, а следствие архитектуры трансформеров и lossy-сжатия информации. Аналогия с человеческой памятью. 6 мин чтения 7799 DGX Spark плавится? Собираем систему охлаждения с интеллектом, а не просто вентиляторы Готовое решение для перегрева DGX Spark: список железа, схема сборки и Python-скрипт для автоматического управления вентиляторами по температуре GPU. 8 мин чтения 7800 Nano Banana против Gemini 2.5 Flash: битва за согласованность персонажей и 20 способов это использовать Разбираемся, чем Nano Banana отличается от Gemini 2.5 Flash, какую модель выбрать для работы с изображениями и персонажами. 20 реальных кейсов использования. 10 мин чтения