Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
7789
Как выбрать самый дешёвый GPU-провайдер для запуска своей модели: сравнение Hyperstack, Runpod и облачных хранилищ
Практическое руководство по выбору самого дешёвого GPU для LLM. Сравнение цен Hyperstack и Runpod, оптимизация хранения в Cloudflare R2, Wasabi, AWS S3. Пошагов
7790
Дешёвый AI-инференс: как они это делают и почему вам стоит волноваться
Разбираемся, как работают дешёвые облачные AI-сервисы. Технические оптимизации, бизнес-модели и скрытые риски, о которых молчат провайдеры.
7791
DGX OS умер, да здравствует Ubuntu: как вырвать телеметрию NVIDIA и заставить железо работать на LLM
Полный гайд по замене DGX OS на Ubuntu для Spark/DGX. Удаляем телеметрию NVIDIA, настраиваем железо для локальных LLM, отключаем интернет-зависимость.
7792
Полное руководство: от обучения LLM с нуля до публикации на Hugging Face
Пошаговый гайд по обучению языковых моделей с нуля, оценке качества и публикации на Hugging Face Hub. От данных до продакшена.
7793
Lynkr: ваш личный диспетчер для 15+ LLM, который экономит деньги и нервы
Обзор Lynkr — open-source прокси для интеллектуальной маршрутизации запросов между 15+ LLM провайдерами, включая локальные модели Ollama. Экономит до 70% на API
7794
LM Studio на Mac M5: Когда Metal API сходит с ума и модель падает с Exit code 6
Полное решение ошибок LM Studio на Mac с M5 чипом: 'model crashed', 'Metal API kernel loading', Exit code 6. Пошаговый гайд с настройками GGUF моделей и сравнен
7795
Создаем аудиокнигу на ноутбуке с удаленным GPU: Docker, XTTS и немного магии
Пошаговый туториал по созданию аудиокниг на своем компьютере с использованием Docker, XTTS модели и удаленного GPU через SSH. Без облаков, без подписок.
7796
Когда MCP отвечают как бабушки в очереди: как mcp-context-proxy режет болтовню
Обзор инструмента для сжатия ответов Model Context Protocol. Экономим токены, ускоряем работу локальных LLM. Установка, настройка, сравнение с альтернативами.
7797
T-Scan: Практическое руководство по визуализации внутренних активаций трансформеров
Пошаговое руководство по T-Scan - инструменту для визуализации внутренних активаций трансформеров. Установка, примеры использования, сравнение с альтернативами.
7798
Эффект Манделы в ИИ: Почему галлюцинации LLM — это не баг, а фундаментальное свойство архитектуры
Глубокий анализ почему галлюцинации в LLM — это не ошибка, а следствие архитектуры трансформеров и lossy-сжатия информации. Аналогия с человеческой памятью.
7799
DGX Spark плавится? Собираем систему охлаждения с интеллектом, а не просто вентиляторы
Готовое решение для перегрева DGX Spark: список железа, схема сборки и Python-скрипт для автоматического управления вентиляторами по температуре GPU.
7800
Nano Banana против Gemini 2.5 Flash: битва за согласованность персонажей и 20 способов это использовать
Разбираемся, чем Nano Banana отличается от Gemini 2.5 Flash, какую модель выбрать для работы с изображениями и персонажами. 20 реальных кейсов использования.