Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

7381 RTX 5090 под прессом: как разогнать новую сборку до предела на LoRA и ComfyUI Пошаговый гайд по нагрузочному тестированию новой сборки с RTX 5090 и 128 ГБ RAM. Проверяем пределы системы на реальных задачах: обучение LoRA и сложные workflo 9 мин чтения 7382 От теории к практике: пошаговый план для AI-инженера после книги Чипа Хуена Конкретный пошаговый план от теории к практике: проекты на LangGraph и CrewAI, оценка RAG пайплайнов, создание портфолио и поиск работы в AI Engineering. 9 мин чтения 7383 Ollama vs llama.cpp: как заставить работать несовместимые видеокарты вместе (3060 и P102-100) Пошаговое руководство по настройке llama.cpp и Ollama для работы с разными видеокартами. Оптимизация VRAM, команды tensor-split, сравнение производительности. 7 мин чтения 7384 SimpleLLM vs vLLM: когда скорость важнее латентности Сравнение SimpleLLM и vLLM, тесты на GPU, как запустить минимальный движок для GPT-OSS-120B с максимальной пропускной способностью. 7 мин чтения 7385 Скупой платит дважды: почему PCIe 5.0 для MoE-инференса — это ловушка, а не панацея Собираем сервер для Mixtral, DeepSeek MoE на RTX 5090. Сравнение PCIe 4.0 и 5.0, DDR4/DDR5 для vLLM. Экономия $5K с потерей всего 35% в prefill. 8 мин чтения 7386 GLM-4.7 на четырех RTX 3090: выжимаем последние токены с ik_llama.cpp Подробный разбор настройки GLM-4.7 на 4x RTX 3090 для максимальной производительности. Таблицы бенчмарков, конфигурации Docker и ошибки. 8 мин чтения 7387 Гроk и скандал с фейковыми нюдами: как отсутствие безопасных фильтров привело к волне неконсенсуального контента Как ИИ Grok от xAI создавал неконсенсуальный контент без фильтров. Реакция регуляторов и последствия для безопасности искусственного интеллекта. 4 мин чтения 7388 Aventura: Когда SillyTavern слишком глуп, а OpenRouter слишком дорог Полное руководство по установке Aventura — приватного фронтенда для ролевых игр и творческого письма с локальными моделями, долгосрочной памятью и анти-слоп сис 8 мин чтения 7389 Критическая дыра в llama.cpp: как проверить версию и не стать жертвой RCE-атаки Подробный гайд по критической уязвимости в llama.cpp (CVE в разработке). Как проверить свою версию, понять механизм атаки через n_discard и защититься от удалён 9 мин чтения 7390 Как Llama 3.1 предсказывает суицидальные мысли лучше психологов: разбираем исследование с 75% точностью Глубокий разбор исследования, где perplexity от Llama 3.1 предсказывает суицидальный риск с 75% точностью. Код, пайплайн, ошибки и почему это работает. 7 мин чтения 7391 Когда Sonnet 3.7 умирает: что писать на Mac M2 Ultra с 192GB памяти GLM 4.7, 4.5 Air, Intellect 3 — тестируем локальные модели для творчества на Mac. Сравнение качества, скорости, потребления памяти. 6 мин чтения 7392 Построение локального AI-сервера с доступом к файлам: выбор железа, Proxmox, Docker и GPU Подробное руководство по сборке и настройке локального AI-сервера с доступом к файлам. Выбор железа (Epyc, ZFS), настройка Proxmox, Docker и серверных GPU. 7 мин чтения