Claude Haiku 5.5: el modelo pequeño más barato y rápido de Anthropic

Anthropic lanza Claude Haiku 5.5, su modelo pequeño más económico y veloz hasta la fecha. Diseñado para tareas de alto volumen y bajo costo, reduce el precio un 75% frente a Haiku 4.5 y multiplica su rendimiento en benchmarks de razonamiento, uso de computadora y codificación agéntica. También baja el precio de las lecturas de caché de Sonnet 5.5 y añade créditos mensuales de API para suscriptores Max y Team.

Estamos muy impresionados con Claude Haiku 5.5, especialmente con su velocidad. En comparación con el modelo que usamos hoy, vimos una reducción de más del 30% en la latencia para completar tareas y hasta 2.5 veces más rápida la inferencia por turno de agente. Es una experiencia notablemente más ágil.
  1. simonw

    Pelícanos montando en bicicleta para Haiku en los diferentes niveles de pensamiento: https://tools.simonwillison.net/markdown-svg-renderer?url=ht...

    Low estropea el cuadro de la bicicleta, pero medium/high/xhigh/max aciertan todos con el cuadro de la bicicleta.

    El de max tardó 5 minutos 9 segundos y costó 3.3826 centavos. El más barato (low) costó 0.0936 centavos y tardó 7 segundos.

    La versión más reciente de mi plugin llm-anthropic consulta directamente la API de listado de modelos de Anthropic, así que no tuve que actualizar el plugin para añadir soporte para este modelo:

    llm install llm-anthropic -U

    llm anthropic refresh

    llm -m claude-haiku-5.5 'prompt goes here'

    EDIT: Aquí está el pelícano de Haiku 4.5 de hace un año para comparar, era terrible: https://simonwillison.net/2025/Oct/15/claude-haiku-45/

  2. minimaxir

    El precio es... un poco raro.

    Entrada

    $0.10 / MTok para prompts de hasta 100,000 tokens

    $0.50 / MTok para prompts de más de 100,000 tokens

    Salida

    $0.50 / MTok para prompts de hasta 100,000 tokens

    $2.50 / MTok para prompts de más de 100,000 tokens

    100k tokens es un corte absurdamente bajo y solo aplica a Haiku, no a Sonnet ni a Opus. Es un corte lo bastante bajo como para superarlo rápidamente si haces cualquier cosa con Agentes; para generación típica o clasificadores tipo Jev, es una buena relación calidad-precio y, como se señala en este artículo, aparentemente esa es la gran mayoría del uso de Haiku.

    En ambos casos, sigue siendo mucho más barato que los $1 de entrada / $5 de salida de Haiku 4.5, y estos precios compiten mejor con GPT-6 Luna. ($0.10 de entrada / $0.50 de salida, pero sin umbral de tokens [EDIT: el umbral de Luna aparentemente es 272k])

  3. charlesabarnes

    > Segundo, esta semana lanzaremos un nuevo crédito mensual de API para todos los suscriptores de Max y Team para usar en la Claude Platform. Los usuarios de Max 5x recibirán $100 en créditos al mes, los de Max 20x recibirán $200, y los suscriptores de Team recibirán hasta $500, agrupados entre sus usuarios

    Esto es un beneficio enorme para mí. Ahora puedo lanzar funciones reales mejoradas con IA detrás de mi suscripción sin pagar extra ni depender totalmente de modelos en el dispositivo. Me preocupa que esto sea para suavizar el golpe de cambios poco amigables para el usuario

  4. chriddyp

    Ejecutamos nuestro benchmark DataAnalyticsBench con él: https://plotly.com/blog/claude-haiku-5-5-plotly-data-analyti...

    9 veces más barato que Haiku 4.5 y 2 letras de calificación mejor. También es ahora el modelo más rápido (usando las velocidades por defecto, sin probar el modo "Fast" de los otros modelos) en completar el examen.

    Similar a Luna en precio, coste y precisión. Son modelos muy baratos: $0.38 por responder 40 preguntas en profundidad de análisis de datos (comparado con $15 para Opus 5.5 o $20 para Astra).

    En general muy bueno en análisis de datos: maneja correctamente todas las preguntas de análisis de datos sencillas. Se quedó corto respondiendo algunas de las preguntas que requerían un análisis estadístico más profundo, como mirar otras variables. En otras palabras, no es tan persistente como otros modelos en su análisis, lo cual creo que era de esperar por cómo están posicionando el modelo.

    Comparado con OpenAI: GPT-6 Luna lo hizo un poco mejor y costó alrededor del 30% de lo que cuesta Haiku 5.5. GPT-6.1 Sol acertó todas las respuestas, pero era 10 veces más caro.

  5. simonw

    Mi queja sobre Haiku 4.5 era que costaba 10 veces más que GPT-6 Luna.

    > Claude Haiku 5.5 tiene un precio 90% menor que Claude Haiku 4.5 para solicitudes de hasta 100,000 tokens, y 50% menor para solicitudes de más de 100,000 tokens

    Haiku y Luna ahora tienen exactamente el mismo precio hasta 100,000 tokens. Luna ahora es más barato para cualquier cosa después de 100,000 tokens; incluso tras los propios aumentos de precio de Luna a partir de 270,000, sigue siendo menos que Haiku.

    Así que parece que han abordado directamente ese problema. Sus benchmarks autoinformados también son todos superiores a los de Luna.

  6. jjcm

    Hice pruebas de imagen -> html con esto. Tenía curiosidad por saber si este modelo más pequeño era lo bastante bueno para UI compleja. No lo era.

    Haiku 5.5: https://html.non.io/lcars-haiku-5.5/

    Opus 5.5 para comparar: https://html.non.io/lcars-opus-5.5

    Diseños a partir de los que estaba construyendo: https://diffui.ai/app/canvas/5093e689-1e74-4f26-b632-2a4500f...

    Una cosa interesante es que echó un vistazo al trabajo en cuestión y lo delegó inmediatamente a Opus 5.5. Al menos sabe en qué no es bueno. Muy rápido, eso sí, y probablemente se use mejor para pequeñas tareas de subagentes / trabajo muy acotado.

  7. seaal

    Los créditos mensuales de API para el plan Max parecen fantásticos, especialmente considerando el precio de Haiku. Poder usar de verdad mi plan de Claude para otros harnesses y casos de uso además del uso normal de CC es todo lo que quería.

    Anthropic ha estado haciendo todo lo correcto en las últimas semanas, mientras OpenAI sigue echándolo a perder.

  8. wyrdcurt

    Ya era hora de que Anthropic lanzara un modelo barato competitivo. Haiku 4.5 ha sido demasiado caro para su rendimiento durante meses (de hecho, no recuerdo haber quedado muy impresionado ni siquiera cuando salió). Este sí parece que merece la pena usar en algunos escenarios. Si de verdad es tanto mejor que Luna como indican los benchmarks que han mostrado, probablemente reemplace a Luna en mis flujos de trabajo. 100k tokens es un umbral bastante bajo antes de que suba el precio, pero tiendo a usar estos modelos más pequeños para tareas más pequeñas de todos modos.

  9. bouk

    ¡Esto es genial! He estado usando GPT 6 Luna para descompilar mi juego favorito de la infancia (Age of Mythology) y esto significa que puedo meter a Haiku en la mezcla también. 17352/21965 funciones coincidentes hasta ahora...

  10. d1l

    En el trabajo usamos haiku 4.5 para un puñado de tareas sensibles a la latencia que son bastante simples. Rinde bien. Acabo de empezar a probar 5.5, ya que anticipaba una buena mejora desde que se insinuó. Los resultados hasta ahora son basura. Incluso filtración de prompt. Y es más lento. Supongo que es barato, pero creo que han errado el equilibrio con esto.

Más de este día

2026-10-07