Ждать стоит: к зиме 2026–2027 подтверждённые системы со 128–192 ГБ unified memory меняют сам класс покупки за $4 000

Вопрос:

«есть ли смысл сейчас собирать хост для локального запуска llm с бюджетом 4000$? есть позможность подождать 6месяцев, если цена не вырастет»

Уточнение:

«какие релизы железа ожидаются? как они могут повлиять на выбор? как меняются требования к запуску локальных llm?»

Обновление на 06.09.2026: 29 свидетельств с 22 независимых сайтов — 11 ожидаемых релизов и слухов о железе (до марта 2027), 10 моделей с оценками памяти в ГБ и 8 трендов требований. Ни один источник не покрывает больше 3 из 29 строк. Из 11 «релизов» только 3 подтверждены официально; остальное — слухи, и покупку на них опирать нельзя.

Дорожка релизов до марта 2027

Цвет — степень подтверждённости; яркие полосы — объявлено или в официальном roadmap, приглушённые — сообщения и слухи. Неопределённые сроки показаны широкими интервалами, а не точками. Цифра — заявленный объём памяти, ГБ.

Лестница памяти: что во что помещается

Модели по оценке памяти при запуске (разные источники используют разные кванты и контексты — цифры сопоставимы лишь ориентировочно). Пунктир — пороги 24, 32, 48, 96, 128 и 192 ГБ. Малое число активных параметров MoE ускоряет генерацию, но все веса всё равно должны храниться в памяти.

Требования вниз — и одновременно вверх

↓ Снижают требования

    ↑ Повышают требования

      Единственные подтверждённые системы окна ожидания: AMD Ryzen AI Max+ 495 «Gorgon Halo» со 192 ГБ unified memory (Q3 2026, официальный roadmap) и NVIDIA RTX Spark со 128 ГБ LPDDR5X и CUDA (осень 2026) — pinggy.io
      Apple Mac Mini M6 «22 сентября» и вся линейка M5/M6 с 256–512 ГБ известны только по вторичным страницам; первичного подтверждения производителя в данных нет, на выбор это влиять не должно — memeburn.com
      RTX 5090 Ti на 36 ГБ, RTX 50 SUPER и 4090 Super — слухи; даже если верны, 32–36 ГБ не меняют класс доступных моделей так, как переход к 96–192 ГБ — compute-market.com
      Один и тот же Qwen 235B MoE оценивается в 55–160 ГБ в зависимости от кванта и контекста: «модель помещается» — вопрос формата, а не только железа — local-ai-models.ai
      KV-cache растёт линейно с контекстом и может достигать 40 ГиБ на одну последовательность — закладывайте 20–30% памяти сверх весов — kaoutarelmaghraoui.com

      Все 29 строк

      СекцияПунктКатегорияСрок / статусГБДостоверностьИсточник

      Метод: 29 строк из веб-источников на 06.09.2026 — 11 ожидаемых релизов/слухов железа, 10 моделей с оценками памяти при запуске (ГБ, разные кванты и контексты), 8 трендов требований; 22 независимых хоста, максимум 3 строки на один URL. Даты неподтверждённых релизов показаны интервалами по формулировкам источников. Цены и сроки будущих продуктов изменчивы — перепроверьте перед покупкой; полные тексты implication сокращены для места.

      This report was generated automatically by Keenable SELECT at a user's request, from publicly available web sources linked herein. Keenable does not review, verify, or endorse its contents and makes no representation as to accuracy, completeness, or timeliness; AI-based extraction may contain errors. Nothing in this report is investment, legal, financial, or other professional advice. All trademarks and referenced content remain the property of their respective owners; no affiliation or endorsement is implied. To report an error, rights concern, or request removal: legal@keenable.ai.

      Keenable SELECTAsk your own question
      Made with Keenable SELECT