Короткий ответ: покупать Strix Halo сейчас или ждать
Универсальной рекомендации нет. Покупка Strix Halo сейчас - это компромисс между маржинальными скидками, которые доступны на текущие конфигурации, и риском, что привычного поколенческого снижения цен на прошлое поколение не случится. Главная причина - рост цен на память, который напрямую бьёт по себестоимости платформы с унифицированной LPDDR5X.
В сообществе локальных LLM этот вопрос обсуждают на фоне скорого выхода платформы 495+. Автор обсуждения сомневается в типичном снижении цен и предлагает другой сценарий: новые модели встанут на ступень выше по цене, а старые останутся на прежнем уровне (Bad time to purchase strix halo?). Это мнение участника обсуждения, а не подтверждённый факт рынка, и относиться к нему стоит соответственно.
Дальше решение сводится к четырём переменным: готовность ждать, бюджет, требования к тишине и объём памяти, который нужен под ваши модели. Если система нужна для работы сейчас и бюджет позволяет, ожидание может обойтись дороже, чем скидка, которой вы не дождётесь. Если есть рабочая конфигурация и нет срочности, разумнее дождаться официальных анонсов, а не слухов.
Почему RAM crisis меняет привычную логику снижения цен
Обычный цикл выглядит так: выходит новое поколение, старое дешевеет, потому что освобождает место в линейке. В 2026 году этот механизм упирается в стоимость памяти, а не в возраст чипа. Когда дорожает DRAM, производитель не может снизить цену платформы, у которой память - одна из главных статей себестоимости.
«maybe it will simply be a new higher priced tier as the RAM crisis bites»
Формулировка принадлежит участнику обсуждения на r/LocalLLaMA (тред), но описывает сценарий, который стоит держать в голове: новое поколение не вытесняет старое по цене, а надстраивается над ним.
Как рост цен на память влияет на цену Strix Halo
Strix Halo - платформа с унифицированной памятью LPDDR5X, распаянной на плате. Отдельной видеопамяти здесь нет: CPU и iGPU работают с одним пулом. Значит, стоимость памяти входит в цену мини-ПК и ноутбуков на этой платформе напрямую. При дефиците DRAM себестоимость растёт, а не падает, и скидка вендора может исчезнуть быстрее, чем появится новое поколение.
Насколько затяжным может быть дефицит, оценивают по-разному. Прогноз председателя ADATA допускает десятилетний дефицит DRAM и пересмотр сроков закупок у производителей; подробнее об этом в разборе дефицита DRAM и его влияния на рынок AI-решений. Конкретных процентов роста цен в доступных материалах нет, поэтому бюджет разумнее планировать с запасом, а не по прошлогодним прайсам.
Могут ли новые модели занять более высокий ценовой сегмент
Гипотеза из обсуждения звучит так: платформа 495+ не вытеснит Strix Halo, а встанет на ступень выше по цене. Тогда стратегия «подождать и взять прошлое поколение дешевле» не срабатывает, потому что прошлое поколение не дешевеет.
Аргументы за такой сценарий: дорогая память, ограниченный объём производства и необходимость сохранять маржу. Аргументы против: конкуренция между вендорами мини-ПК, складские остатки, которые всё равно нужно распродавать, и возможное смягчение ситуации с DRAM. Ни один из сценариев нельзя считать подтверждённым, пока нет официальных анонсов и опубликованных цен.
Ждать ли выхода 495+ и новых видеокарт NVIDIA и AMD
Ожидание имеет смысл только тогда, когда есть дата и понятная цена. Сейчас нет ни того, ни другого.
Что известно о сроках выхода 495+
Платформа 495+ фигурирует в обсуждении как решение с неминуемым выходом, и именно это подталкивает людей отложить покупку (тред). Конкретные сроки, конфигурации и цены там не называются. Официальных анонсов по этой платформе в доступных материалах нет.
Практический вывод: не строить план покупки на неподтверждённых датах. Если вы решили ждать 495+, заранее определите, что должно измениться в вашем сценарии: цена, объём памяти, качество поддержки в llama.cpp или ROCm, уровень шума. Без этих критериев ожидание превращается в бесконечный цикл, в котором вы каждый месяц откладываете решение.
Официальные комментарии NVIDIA и AMD: чего ждать
По инсайдерским данным, скорого анонса нового поколения видеокарт NVIDIA и AMD ожидать не стоит. Ни NVIDIA, ни AMD официально не комментировали слухи и не называли сроки выхода следующих поколений игровых видеокарт (публикация о переносе анонсов). Это инсайдерская информация, а не подтверждённый план вендоров.
Для решения о покупке важно другое: если обновление дискретных GPU откладывается, давление на цены в сегменте слабое. Откладывать покупку только из-за слухов о «скором» релизе рискованно: слух может не подтвердиться, а память за это время подорожает.
Критерии выбора тихой системы под локальные LLM (Qwen3.8FN и Qwen4)
Если решение о покупке принято, вопрос смещается к конфигурации. В обсуждении отдельно звучит запрос на тихую систему под Qwen3.8FN и будущую Qwen4 (тред).
Объём памяти и запас под будущие модели
Для локального запуска LLM объём памяти критичнее пиковой вычислительной мощности. Модель должна целиком поместиться в память вместе с KV-кэшем. Если часть слоёв уходит на CPU, скорость падает в разы, и комфортная работа заканчивается.
Запас считать нужно не под текущую модель, а под следующую. Qwen4 с высокой вероятностью потребует больше памяти, чем Qwen3.8FN, поэтому конфигурация «ровно под сегодняшнюю модель» быстро упрётся в потолок. Конкретные размеры и квантизации здесь не фиксируем: они меняются от релиза к релизу, а часть весов у моделей с режимом рассуждения съедает контекст быстрее, чем ожидается. Практический ориентир: берите вариант с запасом по памяти под квантизацию выше той, что используете сейчас.
Как unified memory ведёт себя на реальных моделях, разобрано в материале о Strix Halo и 128 ГБ памяти: модели уровня 27-35B остаются рабочим вариантом для кодинга, дальше начинается упор в пропускную способность памяти. Отдельно стоит изучить разбор запуска Qwen3.8-Flash-Next на Strix Halo через Vulkan в llama.cpp, там описаны сборка форка, подключение draft-модели и ограничения конфигурации.
Тишина и охлаждение: на что смотреть
Шум создаёт охлаждение, работающее на высоких оборотах под длительной нагрузкой. Инференс LLM - именно такая нагрузка: он идёт часами, а не минутами, как в коротком бенчмарке.
- Размер вентиляторов: крупные модели (120 мм и больше) дают тот же поток воздуха на меньших оборотах.
- Запас по TDP системы охлаждения: если кулер рассчитан ровно на номинальную мощность, под нагрузкой вентиляторы выйдут на максимум.
- Продув корпуса: сквозная вентиляция снижает температуру внутри и обороты вентиляторов.
- Расположение: мини-ПК с одной турбиной на столе слышно отчётливее, чем корпус под столом.
Конкретные модели кулеров и уровни шума в децибелах зависят от устройства, поэтому смотрите паспорт конкретной сборки, а не общие обещания «тихой работы» в описании товара.
Энергопотребление и апгрейд
Энергопотребление влияет на две вещи: шум и счёт за электричество при круглосуточной работе. Платформа с унифицированной памятью расходует меньше, чем связка CPU и дискретной видеокарты сопоставимой производительности, потому что не тратит энергию на перегонку данных между отдельными пулами памяти.
Обратная сторона: интегрированное решение почти не апгрейдится. Память распаяна, дискретную видеокарту не добавить, объём фиксируется в момент покупки. Если планируете работать с Qwen4 и следующими версиями, берите больше памяти сразу: потом добавить её не получится.
Сценарии: кому покупка Strix Halo сейчас оправдана, а кому стоит подождать
- Система нужна сейчас, бюджет позволяет. Если вы уже упираетесь в память на текущем железе и локальные модели входят в рабочий процесс, покупка оправдана. Скидка, которую вы получите сегодня, может оказаться больше той, что появится через полгода на фоне дорогой памяти.
- Есть рабочая система, срочности нет. Если текущая конфигурация закрывает задачи хотя бы частично, разумно дождаться официальных анонсов и реальных цен, а не слухов. Ограничение: ждать придётся неопределённо долго.
- Планируете апгрейд под Qwen4. Здесь решает запас по памяти, а не цена. Конфигурация с запасом сейчас дешевле, чем покупка новой системы через год.
- Бюджет ограничен. Смотрите альтернативы ниже: иногда дискретная видеокарта с большим объёмом VRAM закрывает задачу за меньшие деньги, но платит за это шумом и энергопотреблением.
Риски и ограничения покупки Strix Halo сейчас
- Устаревание после выхода 495+. Сама по себе платформа не перестанет работать, но внимание вендоров и сообщества сместится, а обновления драйверов могут приходить медленнее.
- Ограниченный апгрейд. Распаянная память и отсутствие слота под дискретную видеокарту закрывают путь к постепенному улучшению.
- Поддержка новых моделей. Свежие архитектуры и форматы квантизации сначала появляются в CUDA, поддержка ROCm и Vulkan приходит с задержкой, иногда через форки llama.cpp.
- Ликвидность на вторичном рынке. Интегрированные решения продаются сложнее, чем десктопные сборки с отдельными комплектующими.
Это не повод отказываться от покупки. Это факторы, которые стоит взвесить до того, как вы оформите заказ.
Альтернативы Strix Halo для локальных LLM
- Дискретная видеокарта с большим объёмом VRAM. Даёт более высокую скорость инференса и гибкость апгрейда, но добавляет шум и энергопотребление. Как оценивать бюджетные варианты, включая модифицированные карты, разобрано в материале о выборе видеокарты для локальных LLM в 2026 году.
- Система из нескольких GPU. Даёт больше суммарной памяти, но требует корпуса с хорошей вентиляцией, мощного блока питания и места, где шум не мешает.
- Облачные решения. Снимают вопросы шума, апгрейда и памяти, но переносят расходы в подписку или оплату по часам и требуют постоянного интернета.
Выбор зависит от приоритетов: тишина и компактность тянут в сторону интегрированной платформы, максимальная скорость и гибкость - в сторону дискретных решений.
Итог: как принять решение
Решение сводится к нескольким факторам: готовность ждать, бюджет, требования к тишине, необходимый объём памяти и ожидания по новым платформам. Проверьте свой случай по короткому списку.
- Система нужна сейчас, бюджет позволяет: покупка Strix Halo оправдана, особенно если важна тишина и компактность.
- Рабочая система есть, срочности нет: ждите официальных анонсов, а не слухов, и заранее определите цену и объём памяти, при которых решение станет очевидным.
- Планируете Qwen4 и следующие версии: берите запас по памяти сразу, добавить её позже не получится.
- Бюджет ограничен: сравните с дискретными картами и облаком, посчитав полную стоимость владения, включая электричество и шум.
Главное, что стоит помнить: привычная схема «новое поколение вышло, старое подешевело» в условиях роста цен на память может не сработать. Планируйте покупку исходя из своих задач и сегодняшних цен, а не из ожидания скидки, которую никто не обещал.