Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

7129 Сборка mixed-vendor кластера для 104B модели: RTX 3090 дружит с RX 7900 XT через RPC Практическое руководство по сборке mixed-vendor кластера для 104B моделей. RTX 3090 и RX 7900 XT через llama.cpp RPC, настройка, проблемы и результат 12.3 tps. 7 мин чтения 7130 Cerebras GLM4.7 REAP: как использовать обрезанные модели для экономии памяти и ускорения Как использовать Cerebras GLM4.7 REAP с 25% и 40% pruning, FP8 и BF16 квантованиями для экономии памяти и ускорения инференса. Практическое руководство. 4 мин чтения 7131 Системный промпт Gemini 3 Pro: анализ утечки и техники jailbreak Полный разбор утекшего системного промпта Gemini 3 Pro. Как работают контекстный поиск, JSON-инструменты и защитные инструкции. Техники jailbreak и prompt injec 4 мин чтения 7132 Китайские роботы захватили CES 2026: как AI-железо из Поднебесной переопределяет будущее На CES 2026 китайские компании показали подавляющее присутствие в AI-железе и робототехнике. Обзор ключевых трендов и того, что это значит для мировой индустрии 3 мин чтения 7133 Партнёрство Apple и Google: как Gemini изменит Siri и экосистему iOS Анализ сенсационного партнёрства Apple и Google. Как Gemini заменит старую Siri, что будет с приватностью и как изменится ваш iPhone уже в этом году. 4 мин чтения 7134 Почему невозможно остановить deepfake порно: разбор судебного иска против ClothOff и xAI Анализ скандального иска из Беларуси против ClothOff и xAI: как deepfake порно с несовершеннолетними обнажает полный провал законов и технологий защиты. 5 мин чтения 7135 Как настроить 4B Text2SQL модель для запросов к CSV: локальный аналог DeepSeek-V3 с Ollama Пошаговый гайд по fine-tuning 4B модели для Text2SQL запросов к CSV файлам. Локальный запуск через Ollama, сравнение с DeepSeek-V3 по скорости и приватности. 8 мин чтения 7136 Почему 90% точности в Text-to-SQL недостаточно: практические проблемы RAG-систем для баз данных Почему метрика точности обманывает в Text-to-SQL. Разбор практических проблем RAG-систем для баз данных и как их решить. 7 мин чтения 7137 MoE на RTX 4090: Как выжать максимум из 24 ГБ VRAM и не сойти с ума Практическое сравнение MoE моделей для RTX 4090. Offloading слоёв, квантование mxfp4 в llama.cpp, снижение потребления VRAM на 40% без потери качества. 8 мин чтения 7138 Интеграция AI в Java/Kotlin проекты: инструменты и архитектурные подходы для Enterprise Практическое руководство по интеграции AI в JVM-проекты для Enterprise. Инструменты, архитектурные подходы, пошаговый план и типичные ошибки. 5 мин чтения 7139 GLM-Image: Китайский гибрид, который генерирует и правит картинки Обзор GLM-Image от Z.AI. Архитектура, возможности text-to-image и image-to-image, сравнение с аналогами, примеры использования. Кому подойдет эта модель? 3 мин чтения 7140 Когда расширенные функции RAG окупаются: цена против точности Анализ затрат и производительности расширенных функций RAG: оптимизация запросов, расширение соседей, гибридный поиск. Когда сложность оправдана? 9 мин чтения