Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

4177 Запрет Anthropic в США: почему Пентагон объявил компанию угрозой национальной безопасности Пентагон объявил Anthropic угрозой национальной безопасности. Подробности скандала, этические ограничения ИИ и последствия для индустрии. Актуально на 28.02.202 4 мин чтения 4178 Топ-10 некитайских open-source моделей ИИ: рейтинг lmarena и сравнение производительности Обзор лучших open-source моделей ИИ от некитайских разработчиков по данным lmarena на 28.02.2026. Сравнение ArenaScore, производительности и рекомендации по выб 10 мин чтения 4179 Запрет Anthropic в правительстве США: что это значит для будущего ИИ и локальных моделей Анализ запрета Anthropic в правительстве США на 2026 год. Как этические ограничения привели к санкциям и что ждет open-source ИИ. 6 мин чтения 4180 Агентный ИИ: от демо к production — архитектура, риски внедрения и ошибки компаний (практика от эксперта МФТИ) Почему 9 из 10 пилотных проектов с AI-агентами проваливаются при выходе в production? Разбор архитектуры, скрытых рисков и фатальных ошибок от эксперта МФТИ с о 5 мин чтения 4181 ChatGPT: 900 млн пользователей и $110 млрд финансирования - что стоит за рекордным ростом OpenAI OpenAI ставит новые рекорды: 900 млн активных пользователей и $110 млрд финансирования. Как Amazon, Nvidia и стратегия экосистемы привели к этому взлету в 2026 4 мин чтения 4182 RAISE Act против Silicon Valley: как закон об AI-безопасности стал полем битвы лоббистов Конфликт вокруг RAISE Act: 125 млн долларов лоббирования, 20 млн от Anthropic и борьба за будущее регулирования ИИ в США. Подробности на 28.02.2026. 5 мин чтения 4183 Как PewDiePie fine-tuned Qwen2.5-Coder-32B превзошел ChatGPT 4o: разбор кейса и методики Как блогер PewDiePie настроил open-source модель Qwen2.5-Coder-32B для кодирования и обогнал ChatGPT 4o в бенчмарках. Методика и результаты на 28.02.2026. 4 мин чтения 4184 DeepSeek DeepGEMM: как обновление с mHC и поддержкой Blackwell ускорит работу LLM Технический обзор DeepSeek DeepGEMM: как обновление с Manifold-constrained Hyper-connections и поддержкой NVIDIA Blackwell ускоряет матричные вычисления для LLM 5 мин чтения 4185 Оптимизация vLLM: как обслуживать Qwen 3.5 в Thinking и Non-Thinking режимах без двойной загрузки в VRAM Гайд по обслуживанию Qwen 3.5 в двух режимах через один экземпляр vLLM. Экономим видеопамять на 50% с помощью chat template kwargs. 7 мин чтения 4186 LLmFit: как одной командой подобрать идеальную LLM-модель под ваше железо Обзор LLmFit - инструмента для подбора LLM-моделей под аппаратное обеспечение. Узнайте, как одной командой найти идеальную модель для вашего GPU и RAM. 5 мин чтения 4187 Как запустить гигантские MoE-модели на одной видеокарте: разбор гибридного рантайма Krasis и бенчмарки Гибридный рантайм Krasis позволяет запускать гигантские MoE-модели на одной видеокарте. Бенчмарки скорости префилла на RTX 5080 и других GPU. 5 мин чтения 4188 Полное руководство по квантованию Qwen3.5-35B-A3B: разбор SOTA GGUFs от Unsloth и лучшие практики Разбор динамических GGUF от Unsloth для Qwen3.5-35B-A3B: KL Divergence, чувствительные тензоры, сравнение методов квантования и рекомендации по выбору. 3 мин чтения