Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
7129
Сборка mixed-vendor кластера для 104B модели: RTX 3090 дружит с RX 7900 XT через RPC
Практическое руководство по сборке mixed-vendor кластера для 104B моделей. RTX 3090 и RX 7900 XT через llama.cpp RPC, настройка, проблемы и результат 12.3 tps.
7130
Cerebras GLM4.7 REAP: как использовать обрезанные модели для экономии памяти и ускорения
Как использовать Cerebras GLM4.7 REAP с 25% и 40% pruning, FP8 и BF16 квантованиями для экономии памяти и ускорения инференса. Практическое руководство.
7131
Системный промпт Gemini 3 Pro: анализ утечки и техники jailbreak
Полный разбор утекшего системного промпта Gemini 3 Pro. Как работают контекстный поиск, JSON-инструменты и защитные инструкции. Техники jailbreak и prompt injec
7132
Китайские роботы захватили CES 2026: как AI-железо из Поднебесной переопределяет будущее
На CES 2026 китайские компании показали подавляющее присутствие в AI-железе и робототехнике. Обзор ключевых трендов и того, что это значит для мировой индустрии
7133
Партнёрство Apple и Google: как Gemini изменит Siri и экосистему iOS
Анализ сенсационного партнёрства Apple и Google. Как Gemini заменит старую Siri, что будет с приватностью и как изменится ваш iPhone уже в этом году.
7134
Почему невозможно остановить deepfake порно: разбор судебного иска против ClothOff и xAI
Анализ скандального иска из Беларуси против ClothOff и xAI: как deepfake порно с несовершеннолетними обнажает полный провал законов и технологий защиты.
7135
Как настроить 4B Text2SQL модель для запросов к CSV: локальный аналог DeepSeek-V3 с Ollama
Пошаговый гайд по fine-tuning 4B модели для Text2SQL запросов к CSV файлам. Локальный запуск через Ollama, сравнение с DeepSeek-V3 по скорости и приватности.
7136
Почему 90% точности в Text-to-SQL недостаточно: практические проблемы RAG-систем для баз данных
Почему метрика точности обманывает в Text-to-SQL. Разбор практических проблем RAG-систем для баз данных и как их решить.
7137
MoE на RTX 4090: Как выжать максимум из 24 ГБ VRAM и не сойти с ума
Практическое сравнение MoE моделей для RTX 4090. Offloading слоёв, квантование mxfp4 в llama.cpp, снижение потребления VRAM на 40% без потери качества.
7138
Интеграция AI в Java/Kotlin проекты: инструменты и архитектурные подходы для Enterprise
Практическое руководство по интеграции AI в JVM-проекты для Enterprise. Инструменты, архитектурные подходы, пошаговый план и типичные ошибки.
7139
GLM-Image: Китайский гибрид, который генерирует и правит картинки
Обзор GLM-Image от Z.AI. Архитектура, возможности text-to-image и image-to-image, сравнение с аналогами, примеры использования. Кому подойдет эта модель?
7140
Когда расширенные функции RAG окупаются: цена против точности
Анализ затрат и производительности расширенных функций RAG: оптимизация запросов, расширение соседей, гибридный поиск. Когда сложность оправдана?