Ждать всё ещё рациональнее; 2×3090 — лучший вариант, если покупать сейчас

Спрошено:

«есть ли смысл сейчас собирать хост для локального запуска llm с бюджетом 4000$? есть позможность подождать 6месяцев, если цена не вырастет»

Предыдущий follow-up:

«какие релизы железа ожидаются? как они могут повлиять на выбор? как меняются требования к запуску локальных llm?»

Follow-up:

«прошло почти две недели. как изменилась ситуация?»

Обновление на 19 сентября 2026: 20 наиболее релевантных событий после 6 сентября из 11 независимых источников (10 по железу и срокам, 10 по моделям и ПО) плюс расширенная хронология из 35 событий 9–18 сентября от 17 хостов. Скорости в tok/s подписаны моделью, квантом, контекстом и числом устройств — напрямую они не сравниваются.

Короткий ответ: за две недели новый бесспорный лучший хост до $4 000 не появился, и рекомендация ждать до зимы стала только сильнее. Если покупать сегодня — 2×RTX 3090 (48 ГБ, CUDA, 27–70B Q4); если можно ждать — дождаться серийной 192-ГБ системы AMD и независимых тестов. Контрольная точка — ноябрь 2026, окончательное решение — январь 2027.

Четыре сдвига за две недели

Стрелка вверх — вариант усилился, вниз — требования ушли дальше от бюджета, горизонталь — ясности больше, но цена не изменилась. Наведите на карточку, чтобы увидеть источник.

Свежие замеры tok/s: каждый в своих условиях

Скорость генерации токенов. Каждая строка подписана моделью, квантом, контекстом и числом устройств: сравнивать столбики напрямую нельзя. Синие — 2×RTX 3090 (~$1 600–1 950 б/у), серые — DGX Spark ($4 699 за FE), фиолетовый — DGX Station GB300 (вне бюджета).

AMD подтвердила Ryzen AI Max PRO: до 192 ГБ unified RAM и 160 ГБ для GPU, заявлены модели до 300B — но это заявление производителя, серийной цены и независимого LLM-теста 192-ГБ системы пока нет · amd.com
DGX Spark FE держится на $4 699 (NVIDIA переводит пакеты на «запрос цены»), а после обновления DGX OS 7.5.0 у пользователей стало доступно на ~7.2 GiB меньше RAM: со 119.5 до 112.3 GiB · forums.developer.nvidia.com, forums.developer.nvidia.com
RTX 5090 исчезла из онлайн-ритейла США: у сторонних продавцов $6 500–9 500, в Micro Center около $4 299 — одна 5090 стала ещё менее рациональной для LLM-хоста за $4 000 · tomshardware.com
DeepSeek V4.1 Flash (552B MoE, 1M контекст, MIT) резко сжал KV-cache до ~890 байт/токен, но официальный FP8-чекпойнт весит 510 ГБ, самый жёсткий community-квант ~169 ГБ, а на старте его не исполняет ни один released-рантайм · dsv41flash.novcog.us.com, dev.to
Mac Studio M5 Ultra (до 512 ГБ unified, 1.2 ТБ/с) открыт к предзаказу, в магазинах 22 сентября; цена $2 499 относится к стартовой конфигурации, не к 512-ГБ версии — до точной цены максимальной памяти это не кандидат для бюджета · images.apple.com

Матрица выбора под ваш приоритет

CUDA и скорость в бюджете сегодня
2×RTX 3090 (48 ГБ)
27–70B Q4 целиком в GPU; Qwen3.8-27B с MTP — 82 tok/s на коротком контексте. Проверка б/у карт, плата с двумя x8+, БП 1500–1600 Вт, охлаждение.
Единая память и большие MoE
Ждать 192-ГБ AMD Ryzen AI Max PRO
До 160 ГБ для GPU и заявленные 300B — но нужны серийная цена и независимые тесты 27B, 70B dense и 100B+ MoE. Контроль: ноябрь 2026.
Компактность + CUDA + 128-ГБ пул
DGX Spark — только при цене около $4 000
Реальные тесты хорошие, но при $4 699 это не лучший value; после обновления ОС доступно ~112 GiB, не 128.
Frontier-модели 500B+
Бюджет $4 000 не подходит
DeepSeek V4.1 Flash: реалистичные конфигурации 256–512 ГБ и незрелые рантаймы. 128–192 ГБ не гарантируют запуск каждой новой модели.

Хронология 9–18 сентября: 35 событий

Полная лента расширенного набора. Форумные замеры — user-reported, не лабораторные обзоры; заявления производителей отмечены отдельно.

ДатаЧтоСобытиеТип свидетельстваИсточник

Данные: 20 отобранных обновлений (11 независимых хостов) и хронология из 35 событий 9–18 сентября 2026 (17 хостов) о железе, моделях и ПО для локального запуска LLM; ни один URL не даёт больше 10% строк. Срез — 19 сентября 2026. tok/s — скорость генерации в конкретной связке модель/квант/контекст/устройства по данным источника; форумные замеры user-reported. Для места события в таблице сокращены до одной строки; полный текст фактов — по ссылкам.

This report was generated automatically by Keenable SELECT at a user's request, from publicly available web sources linked herein. Keenable does not review, verify, or endorse its contents and makes no representation as to accuracy, completeness, or timeliness; AI-based extraction may contain errors. Nothing in this report is investment, legal, financial, or other professional advice. All trademarks and referenced content remain the property of their respective owners; no affiliation or endorsement is implied. To report an error, rights concern, or request removal: legal@keenable.ai.

Keenable SELECTAsk your own question
Made with Keenable SELECT