Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
4765
TiDAR от Nvidia: как архитектура 'Think in Diffusion, Talk in Autoregression' ускорит LLM в разы
Анализ архитектуры TiDAR от Nvidia: как сочетание диффузии и авторегрессии решает проблему простоя GPU и ускоряет инференс LLM в 2.5-4 раза. Технический разбор
4766
OpenAI глотает OpenClaw: зачем им понадобился этот гнилой агент?
Поглощение OpenAI скандального проекта OpenClaw меняет правила игры для Claude и приватности данных. Что это значит для будущего автономных агентов?
4767
397 миллиардов параметров на вашем ПК: запускаем Qwen3.5-397B локально через Unsloth и GGUF
Полное руководство по запуску гигантской MoE-модели Qwen3.5-397B на домашнем ПК. Квантование 4-bit, Unsloth, требования к RAM и GPU, сравнение с GPT-5.2
4768
15 промптов, которые заставят ChatGPT работать вместо QA-инженера
Готовые промпты для анализа требований, тест-дизайна, баг-репортов и регрессии. Экономьте часы рутины с ChatGPT.
4769
Qwen3.5: открытый исходный код или облачная ловушка? Правда о лицензии Alibaba
Разбираем лицензию Qwen3.5: будет ли модель по-настоящему open-source или доступ только через Alibaba Cloud API? Анализ на 16.02.2026.
4770
LeetCode Assembly Dataset: когда компилятор говорит с ИИ на ассемблере
Полный гайд по LeetCode Assembly Dataset: как обучать LLM на 400+ решениях x86-64/ARM64/MIPS64/RISC-V с GCC/Clang оптимизациями для низкоуровневого программиров
4771
Qwen 3.5 и конец эпохи VL-моделей? Анализ нативной архитектуры и будущего мультимодального ИИ
Технический разбор Qwen 3.5 от Alibaba. Почему нативная мультимодальность убивает VL-подход и что это значит для разработчиков в 2026 году.
4772
Qwen 3.5 Plus (397B-A17B): китайский open-source монстр, который не поместится ни в один домашний ПК
Всё о Qwen 3.5 Plus (397B-A17B) - самой большой opensource модели на 16.02.2026. Технические детали, требования к железу и как её запустить.
4773
OpenClaw на российских стероидах: подключаем GigaChat, YandexGPT и Yandex 360 за 30 минут
Пошаговый гайд по подключению GigaChat Pro, YandexGPT 3.0 и Yandex 360 к OpenClaw. Создаем мультиагентного ассистента с российскими AI-сервисами.
4774
Глубокий разбор DGX Spark (GB10) для локального LLM: когда 128 ГБ памяти не спасают, а когда — лучший выбор
Экспертный анализ NVIDIA DGX Spark GB10 для локальных LLM. Сравнение с RTX 4090, тесты памяти, квантование моделей и когда 128 ГБ unified memory действительно н
4775
Bayesian BM25: Когда математика наконец-то починила гибридный поиск
Практический обзор Bayesian BM25 для гибридного поиска в RAG. Решение проблемы Conjunction Shrinkage, сравнение с альтернативами, примеры кода на Python.
4776
AMD vs NVIDIA для обучения LLM: Зачем я продал RX 7900 XTX и купил RTX 3090
Почему ROCm для обучения LLM — это боль в 2026 году. Реальный опыт миграции с RX 7900 XTX на RTX 3090, сравнение производительности и сборка мульти-GPU системы.