Открытые модели продлевают жизнь старым GPU NVIDIA на годы
The Economics of Open-Weight Inference
Исследование Ornn Data показывает, что открытые модели меняют экономику инференса: на A100 вывод gpt-oss-120b обходится дешевле, чем на H100, а пятилетняя аренда A100 сохраняет 80% месячной цены против 44–60% у Hopper и Blackwell. Длительные агенты, батч-оценка и RL нечувствительны к задержке и переносимы между железом, поэтому старые GPU остаются экономически востребованными ещё много лет.
На gpt-oss-120b, разреженной модели с 5,1 млрд активных параметров, A100 выдаёт вывод дешевле, чем H100, как по спотовой цене, так и по трёх- и пятилетним контрактным ценам.