Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

5821 Пишем и делимся высокопроизводительными ROCm-ядрами для PyTorch: полный гайд на примере GEMM Пошаговое руководство по разработке и публикации высокопроизводительных ROCm-ядер для PyTorch на примере GEMM kernel. Инструменты, оптимизации, ошибки. 10 мин чтения 5822 Бесплатный AI-сервер за 30 минут: Qwen2.5-3B на Oracle Cloud с llama.cpp Пошаговое руководство по запуску Qwen2.5-3B на бесплатном сервере Oracle Cloud с llama.cpp, квантованием Q4_K_M и бэкендом для продакшена. CPU-инференс, классиф 9 мин чтения 5823 AI-кодинг 2026: как перейти с ручного программирования на управление агентами (на примере опыта Андрея Карпатого) Андрей Карпатый признал: ручное программирование умирает. Полный гайд по переходу на управление AI-агентами в 2026 году с Claude Opus 4.5 и GPT-5.2. 7 мин чтения 5824 SpaceX, xAI и Tesla: зачем Маску мега-слияние ракет, ИИ и машин Анализ сенсационного мега-слияния компаний Илона Маска. Космические дата-центры, Grok 3.5 в электромобилях и новая индустриальная реальность. 4 мин чтения 5825 Физики взломали диффузию: чип на шуме экономит энергию целой страны Новый чип Normal Computing использует физический шум для генерации изображений. Энергопотребление Stable Diffusion падает в 10 миллиардов раз. Детали технологии 5 мин чтения 5826 Differential Transformer V2: разбор кода и сравнение производительности с V1 Подробный разбор кода Differential Transformer V2 от Microsoft, сравнение производительности с V1, оптимизация внимания и grouped query attention. 8 мин чтения 5827 Zhipu AI и Huawei: как Китай создаёт AI-инфраструктуру без американских чипов Как Zhipu AI с моделью GLM-5 и чипы Huawei Ascend создают независимую AI-экосистему Китая в 2026 году. Технологическая война без NVIDIA. 5 мин чтения 5828 Thinking Machines: как обратный отток мозгов в OpenAI поставил крест на мечте стартапов Массовый исход инженеров из Thinking Machines обратно в OpenAI раскрывает реальную цену талантов в AI. Почему стартапы проигрывают войну за мозги. 5 мин чтения 5829 Повторяем эксперимент Карпати: как за $100 обучить модель лучше GPT-2 Практическое руководство по повторению эксперимента Андрея Карпати — обучение nanochat модели, превосходящей GPT-2, всего за $100. Архитектура, код, нюансы. 7 мин чтения 5830 Маленькие LLM против гигантов: когда ваш ноутбук сможет заменить Gemini 3 Flash Экспертный разбор: смогут ли маленькие LLM на вашем ПК заменить Gemini 3 Flash для генерации JSON и игр. Квантование, MoE, дистилляция и реалистичные сроки. 7 мин чтения 5831 Kanade Tokenizer: супербыстрое клонирование голоса на CPU с RTF <1 и GUI Обзор Kanade Tokenizer - инструмента для супербыстрого клонирования голоса на CPU с RTF <1 и двумя GUI. Сравнение с RVC, примеры использования. 6 мин чтения 5832 LLM-IDS/IPS для nginx на DGX Spark: строим систему безопасности на gpt-oss-120b Создаем систему обнаружения атак для nginx на локальном DGX Spark с gpt-oss-120b. Полный туториал: архитектура, ложные срабатывания, Telegram-уведомления, автоб 10 мин чтения