Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
3517
Abliterated Qwen 3.5 2B: как скачать и использовать модель с рекордно низким KL-расхождением
Как использовать Abliterated Qwen 3.5 2B с рекордно низким KL-расхождением для улучшения текстов и снятия цензуры. Полное руководство на 2026 год.
3518
Covenant-72B и SparseLoco: как обучать гигантские ИИ-модели на видеокартах геймеров
Анонс модели Covenant-72B и метода SparseLoco. Как децентрализованное обучение на permissionless GPU ломает монополию гигантов на создание больших языковых моде
3519
Исправленный чат-шаблон для Qwen 3.5: полное руководство по настройке tool calling, агентских циклов и стриминга
Готовый инструмент с исправлениями багов Qwen 3.5. Настройка tool calling, агентских циклов, стриминга для llama.cpp, Open WebUI, vLLM. Руководство на 2026 год.
3520
Nvidia DGX Station 2026: персональный суперкомпьютер, который не стоит под столом
Полный разбор Nvidia DGX Station на архитектуре Blackwell. Аппаратные монстры GB300, 1 ТБ памяти и реальная стоимость владения в 2026 году. Для кого это и почем
3521
Mistral-Small-4-119B-NVFP4: Зачем французы затачивают ИИ под чипы NVIDIA и как это использовать
Что такое формат NVFP4, как он ускоряет Mistral-Small-4-119B на GPU NVIDIA Blackwell и пошаговый гайд по запуску. Сравнение с INT4 и MXFP4.
3522
LangChain и NVIDIA сливаются в экстазе: новая платформа для enterprise-агентов готова разорвать рынок
Разбор партнерства LangChain и NVIDIA: как новая платформа для production-агентов изменит разработку AI в 2026 году. Актуальные детали на 17 марта.
3523
Nvidia Blackwell и Rubin: триллионный прогноз, который сломает рынок ИИ-железа
Как прогноз продаж чипов Nvidia в $1 трлн изменит аппаратное обеспечение для ИИ. Новые архитектуры Blackwell и Rubin, производительность, инференс.
3524
MaximusLLM: Тренируй гигантские модели на картошке — один T4 и никакого стресса
Как тренировать большие языковые модели на слабом железе с помощью MaximusLLM. Ghost Logit Loss, Kronecker Sketching и другие техники экономии VRAM.
3525
NVIDIA Groq 3: как чип для инференса LPU изменит скорость работы AI-моделей
NVIDIA представила Groq 3 на GTC 2026. Специализированный чип LPU ускоряет инференс языковых моделей в 15 раз. Детали архитектуры и влияние на рынок.
3526
Визуальная память для ИИ: почему роботы и очки теперь запоминают всё, что видят
Как NVIDIA Cosmos-Reason 2 и стартап Memories.ai учат ИИ запоминать физический мир. Новые технологии для роботов и умных очков на 2026 год.
3527
Mistral Small 4: Французский эксперт, который съедает 128 котлет, но переваривает только две
Полный разбор Mistral Small 4: архитектура MoE 128/4, 119B параметров, мультимодальность. API, сравнение с GPT-4.5 и Claude 3.5, кому подходит в 2026.
3528
ИИ против дипломов: какие профессии в России под ударом - анализ 142 специальностей
Карта профессий Карпаты показала, какие специальности в России наиболее уязвимы перед ИИ. Рискует ли высшее образование? Анализ 142 позиций на 16.03.2026.