Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

5833 Бесплатный AI-сервер за 30 минут: Qwen2.5-3B на Oracle Cloud с llama.cpp Пошаговое руководство по запуску Qwen2.5-3B на бесплатном сервере Oracle Cloud с llama.cpp, квантованием Q4_K_M и бэкендом для продакшена. CPU-инференс, классиф 9 мин чтения 5834 AI-кодинг 2026: как перейти с ручного программирования на управление агентами (на примере опыта Андрея Карпатого) Андрей Карпатый признал: ручное программирование умирает. Полный гайд по переходу на управление AI-агентами в 2026 году с Claude Opus 4.5 и GPT-5.2. 7 мин чтения 5835 SpaceX, xAI и Tesla: зачем Маску мега-слияние ракет, ИИ и машин Анализ сенсационного мега-слияния компаний Илона Маска. Космические дата-центры, Grok 3.5 в электромобилях и новая индустриальная реальность. 4 мин чтения 5836 Физики взломали диффузию: чип на шуме экономит энергию целой страны Новый чип Normal Computing использует физический шум для генерации изображений. Энергопотребление Stable Diffusion падает в 10 миллиардов раз. Детали технологии 5 мин чтения 5837 Differential Transformer V2: разбор кода и сравнение производительности с V1 Подробный разбор кода Differential Transformer V2 от Microsoft, сравнение производительности с V1, оптимизация внимания и grouped query attention. 8 мин чтения 5838 Zhipu AI и Huawei: как Китай создаёт AI-инфраструктуру без американских чипов Как Zhipu AI с моделью GLM-5 и чипы Huawei Ascend создают независимую AI-экосистему Китая в 2026 году. Технологическая война без NVIDIA. 5 мин чтения 5839 Thinking Machines: как обратный отток мозгов в OpenAI поставил крест на мечте стартапов Массовый исход инженеров из Thinking Machines обратно в OpenAI раскрывает реальную цену талантов в AI. Почему стартапы проигрывают войну за мозги. 5 мин чтения 5840 Повторяем эксперимент Карпати: как за $100 обучить модель лучше GPT-2 Практическое руководство по повторению эксперимента Андрея Карпати — обучение nanochat модели, превосходящей GPT-2, всего за $100. Архитектура, код, нюансы. 7 мин чтения 5841 Маленькие LLM против гигантов: когда ваш ноутбук сможет заменить Gemini 3 Flash Экспертный разбор: смогут ли маленькие LLM на вашем ПК заменить Gemini 3 Flash для генерации JSON и игр. Квантование, MoE, дистилляция и реалистичные сроки. 7 мин чтения 5842 Kanade Tokenizer: супербыстрое клонирование голоса на CPU с RTF <1 и GUI Обзор Kanade Tokenizer - инструмента для супербыстрого клонирования голоса на CPU с RTF <1 и двумя GUI. Сравнение с RVC, примеры использования. 6 мин чтения 5843 LLM-IDS/IPS для nginx на DGX Spark: строим систему безопасности на gpt-oss-120b Создаем систему обнаружения атак для nginx на локальном DGX Spark с gpt-oss-120b. Полный туториал: архитектура, ложные срабатывания, Telegram-уведомления, автоб 10 мин чтения 5844 Tapes.dev: когда твой AI-агент наконец-то перестал быть черным ящиком Обзор Tapes.dev - open-source инструмента для отслеживания, поиска и воспроизведения сессий локальных AI-агентов. Git для нейросетей. 7 мин чтения