Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
7369
Гонка вооружений в Китае: как GLM, Minimax и Moonshot (Kimi) тратят миллиарды на LLM-революцию
Как китайские стартапы GLM, Minimax и Moonshot AI вкладывают миллиарды в языковые модели, меняя глобальную конкуренцию в ИИ.
7370
CES 2024: почему энтузиасты локального AI остались с пустыми руками
Обзор почему CES 2024 не показал прорыва в аппаратном ускорении ИИ. Альтернативы апгрейду: квантование, оптимизация ПО, Phison AiDaptiv+. Что делать, если желез
7371
Архитектура on-prem AI стека: Frigate + n8n + локальные LLM + MCP серверы для автоматизации предприятия
Полное руководство по сборке локального AI стека для автоматизации производства. Frigate для компьютерного зрения, n8n для оркестрации, локальные LLM и MCP серв
7372
Mac Studio M3 Ultra для локальных LLM: реальные тесты GLM-4.7 Q4 и оптимизация под 1-2 запроса
Практический гайд по выбору Mac Studio M3 Ultra для локальных LLM. Тесты производительности GLM-4.7 Q4, оптимизация под 1-2 concurrent requests, сравнение конфи
7373
Как Allianz заставила Claude считать деньги и не врать: архитектура ответственного ИИ для корпораций
Как страховая компания Allianz внедрила Claude с системой логгирования и контроля. Детали архитектуры, кастомные агенты и реальные результаты.
7374
Аргументы llama.cpp: от слепого копирования команд к осознанной настройке под любое железо
Исчерпывающее руководство по аргументам командной строки llama.cpp. Настройка производительности под разное железо, примеры команд для CPU, NVIDIA, AMD, разбор
7375
Когда AI становится системным администратором: настраиваем Linux-сервер через Qwen и Cursor
Полное руководство по настройке Linux-сервера с помощью Qwen и Cursor AI. Обход блокировок, автоматизация администрирования, Infrastructure as Code через нейрос
7376
Когда vLLM ломается на двух RTX 6000: полное расследование сбоев и пошаговое лечение
Подробное руководство по диагностике и решению проблем vLLM на сервере с двумя RTX 6000. Настройка питания GPU, PCIe ASPM, NVIDIA persistent mode и другие фиксы
7377
480 миллиардов против здравого смысла: какой open-source кодогенератор реально работает в 2026
Реальный тест больших open-source моделей для кодинга: Qwen Coder 480B, Kimi K2, GLM 4.7. Железо, качество кода, мусор в ответах — что выбрать?
7378
Почему ИИ-ассистенты ломаются в бизнес-среде: анализ проблемы контекста и инженерные решения
Разбор реальных причин провала ИИ-ассистентов в бизнесе. Инженерные подходы: RAG для корпоративных данных, fine-tuning моделей, онтологии. Практические решения
7379
nanoRLHF: Когда образовательный проект бьет по зубам промышленные фреймворки
Разбираем nanoRLHF — минималистичную реализацию RLHF с Flash Attention и Triton. Образовательный проект, который обучил Qwen3 и показал, как работают большие фр
7380
Полный гайд по квантованию в vLLM: сравниваем AWQ, GPTQ, Marlin, GGUF и BitsandBytes на Qwen2.5-32B
Технический разбор пяти методов 4-битного квантования в vLLM: производительность, качество и практический выбор для Qwen2.5-32B.