Los modelos abiertos mantienen vivos los GPU antiguos: el A100 produce tokens más baratos que el H100

The Economics of Open-Weight Inference

Los modelos abiertos mantienen vivos los GPU antiguos: el A100 produce tokens más baratos que el H100

Un análisis de Ornn Data muestra que los modelos de pesos abiertos cambian la economía de la inferencia: en tareas comparables, el modelo abierto más barato cuesta una quinta parte que uno cerrado similar. Al autoalojar, el costo por millón de tokens de salida cae a $0.12–$0.35, y en gpt-oss-120b el A100 supera al H100 en eficiencia. Los precios de alquiler reflejan esta utilidad: el A100 a cinco años conserva el 80% de su tarifa mensual, frente al 44–60% de Hopper y Blackwell.

El precio de alquiler del A100 a cinco años mantiene el 80 por ciento de su precio a un mes (frente al 44 al 60 por ciento de las familias Hopper y Blackwell) para un contrato que finaliza cuando la familia Ampere tiene más de once años.

Más de este día

2026-09-22