Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
5821
Пишем и делимся высокопроизводительными ROCm-ядрами для PyTorch: полный гайд на примере GEMM
Пошаговое руководство по разработке и публикации высокопроизводительных ROCm-ядер для PyTorch на примере GEMM kernel. Инструменты, оптимизации, ошибки.
5822
Бесплатный AI-сервер за 30 минут: Qwen2.5-3B на Oracle Cloud с llama.cpp
Пошаговое руководство по запуску Qwen2.5-3B на бесплатном сервере Oracle Cloud с llama.cpp, квантованием Q4_K_M и бэкендом для продакшена. CPU-инференс, классиф
5823
AI-кодинг 2026: как перейти с ручного программирования на управление агентами (на примере опыта Андрея Карпатого)
Андрей Карпатый признал: ручное программирование умирает. Полный гайд по переходу на управление AI-агентами в 2026 году с Claude Opus 4.5 и GPT-5.2.
5824
SpaceX, xAI и Tesla: зачем Маску мега-слияние ракет, ИИ и машин
Анализ сенсационного мега-слияния компаний Илона Маска. Космические дата-центры, Grok 3.5 в электромобилях и новая индустриальная реальность.
5825
Физики взломали диффузию: чип на шуме экономит энергию целой страны
Новый чип Normal Computing использует физический шум для генерации изображений. Энергопотребление Stable Diffusion падает в 10 миллиардов раз. Детали технологии
5826
Differential Transformer V2: разбор кода и сравнение производительности с V1
Подробный разбор кода Differential Transformer V2 от Microsoft, сравнение производительности с V1, оптимизация внимания и grouped query attention.
5827
Zhipu AI и Huawei: как Китай создаёт AI-инфраструктуру без американских чипов
Как Zhipu AI с моделью GLM-5 и чипы Huawei Ascend создают независимую AI-экосистему Китая в 2026 году. Технологическая война без NVIDIA.
5828
Thinking Machines: как обратный отток мозгов в OpenAI поставил крест на мечте стартапов
Массовый исход инженеров из Thinking Machines обратно в OpenAI раскрывает реальную цену талантов в AI. Почему стартапы проигрывают войну за мозги.
5829
Повторяем эксперимент Карпати: как за $100 обучить модель лучше GPT-2
Практическое руководство по повторению эксперимента Андрея Карпати — обучение nanochat модели, превосходящей GPT-2, всего за $100. Архитектура, код, нюансы.
5830
Маленькие LLM против гигантов: когда ваш ноутбук сможет заменить Gemini 3 Flash
Экспертный разбор: смогут ли маленькие LLM на вашем ПК заменить Gemini 3 Flash для генерации JSON и игр. Квантование, MoE, дистилляция и реалистичные сроки.
5831
Kanade Tokenizer: супербыстрое клонирование голоса на CPU с RTF <1 и GUI
Обзор Kanade Tokenizer - инструмента для супербыстрого клонирования голоса на CPU с RTF <1 и двумя GUI. Сравнение с RVC, примеры использования.
5832
LLM-IDS/IPS для nginx на DGX Spark: строим систему безопасности на gpt-oss-120b
Создаем систему обнаружения атак для nginx на локальном DGX Spark с gpt-oss-120b. Полный туториал: архитектура, ложные срабатывания, Telegram-уведомления, автоб