Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
4177
Запрет Anthropic в США: почему Пентагон объявил компанию угрозой национальной безопасности
Пентагон объявил Anthropic угрозой национальной безопасности. Подробности скандала, этические ограничения ИИ и последствия для индустрии. Актуально на 28.02.202
4178
Топ-10 некитайских open-source моделей ИИ: рейтинг lmarena и сравнение производительности
Обзор лучших open-source моделей ИИ от некитайских разработчиков по данным lmarena на 28.02.2026. Сравнение ArenaScore, производительности и рекомендации по выб
4179
Запрет Anthropic в правительстве США: что это значит для будущего ИИ и локальных моделей
Анализ запрета Anthropic в правительстве США на 2026 год. Как этические ограничения привели к санкциям и что ждет open-source ИИ.
4180
Агентный ИИ: от демо к production — архитектура, риски внедрения и ошибки компаний (практика от эксперта МФТИ)
Почему 9 из 10 пилотных проектов с AI-агентами проваливаются при выходе в production? Разбор архитектуры, скрытых рисков и фатальных ошибок от эксперта МФТИ с о
4181
ChatGPT: 900 млн пользователей и $110 млрд финансирования - что стоит за рекордным ростом OpenAI
OpenAI ставит новые рекорды: 900 млн активных пользователей и $110 млрд финансирования. Как Amazon, Nvidia и стратегия экосистемы привели к этому взлету в 2026
4182
RAISE Act против Silicon Valley: как закон об AI-безопасности стал полем битвы лоббистов
Конфликт вокруг RAISE Act: 125 млн долларов лоббирования, 20 млн от Anthropic и борьба за будущее регулирования ИИ в США. Подробности на 28.02.2026.
4183
Как PewDiePie fine-tuned Qwen2.5-Coder-32B превзошел ChatGPT 4o: разбор кейса и методики
Как блогер PewDiePie настроил open-source модель Qwen2.5-Coder-32B для кодирования и обогнал ChatGPT 4o в бенчмарках. Методика и результаты на 28.02.2026.
4184
DeepSeek DeepGEMM: как обновление с mHC и поддержкой Blackwell ускорит работу LLM
Технический обзор DeepSeek DeepGEMM: как обновление с Manifold-constrained Hyper-connections и поддержкой NVIDIA Blackwell ускоряет матричные вычисления для LLM
4185
Оптимизация vLLM: как обслуживать Qwen 3.5 в Thinking и Non-Thinking режимах без двойной загрузки в VRAM
Гайд по обслуживанию Qwen 3.5 в двух режимах через один экземпляр vLLM. Экономим видеопамять на 50% с помощью chat template kwargs.
4186
LLmFit: как одной командой подобрать идеальную LLM-модель под ваше железо
Обзор LLmFit - инструмента для подбора LLM-моделей под аппаратное обеспечение. Узнайте, как одной командой найти идеальную модель для вашего GPU и RAM.
4187
Как запустить гигантские MoE-модели на одной видеокарте: разбор гибридного рантайма Krasis и бенчмарки
Гибридный рантайм Krasis позволяет запускать гигантские MoE-модели на одной видеокарте. Бенчмарки скорости префилла на RTX 5080 и других GPU.
4188
Полное руководство по квантованию Qwen3.5-35B-A3B: разбор SOTA GGUFs от Unsloth и лучшие практики
Разбор динамических GGUF от Unsloth для Qwen3.5-35B-A3B: KL Divergence, чувствительные тензоры, сравнение методов квантования и рекомендации по выбору.