Mercury 2.5: el LLM de difusión más potente del mercado, con un 40% más de inteligencia

Mercury 2.5: el LLM de difusión más potente del mercado, con un 40% más de inteligencia

Inception Labs lanza Mercury 2.5, su modelo de producción más capaz hasta la fecha. Basado en arquitectura de difusión, ofrece un aumento del 40% en inteligencia respecto a Mercury 2, con la misma baja latencia y bajo costo. Alcanza 1.107 tokens por segundo en GPUs NVIDIA, maneja 260K tokens de contexto y tiene un precio de $0.20 por millón de tokens de entrada y $0.75 por salida, con un 80% de descuento en el lanzamiento. El modelo ya se usa en producción para búsqueda, voz y codificación, con mejoras notables como la reducción del 82% en latencia para compactación de contexto en Augment Code. Además, se anuncian las vistas previas de Mercury Voice y Mercury Router.

En voz, la latencia no es un detalle de infraestructura: es la pausa que el interlocutor escucha.

Más de este día

2026-09-08