Step 5 de Stepfun entra en la frontera de Pareto de Artificial Analysis

Stepfun Step 5 Preview (LLM): On AA Pareto frontier

Step 5 de Stepfun entra en la frontera de Pareto de Artificial Analysis

El nuevo modelo Step 5 de Stepfun aparece en la frontera de Pareto de Artificial Analysis, que cruza inteligencia con coste por tarea. El índice v4.3 agrega diez evaluaciones, entre ellas AA-Briefcase, Terminal-Bench 4.0, SciCode y AA-Omniscience, que mide fiabilidad y alucinaciones. El análisis también compara tokens de salida, ventana de contexto y precios de caché, entrada y salida.

AA-Omniscience Index (higher is better) measures knowledge reliability and hallucination. It rewards correct answers, penalizes hallucinations, and has no penalty for refusing to answer.

Más de este día

2026-09-19