IANoticia

Precio de Claude Haiku 5.5, benchmarks y el límite de 100K

El precio de Claude Haiku 5.5 baja 90% a US$0.10 y US$0.50 por millón de tokens, igual que GPT-6 Luna. Cuánto cuesta, quién midió qué y cuándo usar Sonnet.

Basado en fuentes. Escrito a partir de los documentos, reportes y reseñas enlazados en el texto. The Ruling Desk no probó nada de esto en persona. Cómo trabajamos

Jack Clark, cofundador de Anthropic, en el escenario de una sala de conciertos de Oxford, bajo una pantalla con resultados de benchmarks de modelos de IA a lo largo del tiempo
Foto: Mvolz / Wikimedia Commons, CC0

Anthropic lanzó Claude Haiku 5.5 el 7 de octubre de 2026, y el precio de Claude Haiku 5.5 es 90% menor que el de Haiku 4.5 en la mayoría de las solicitudes: US$0.10 por millón de tokens de entrada y US$0.50 por millón de tokens de salida, el mismo precio de lista que GPT-6 Luna de OpenAI. La trampa es una segunda tarifa para prompts de más de 100,000 tokens. Anthropic también reporta grandes mejoras en benchmarks, que salen de su propia tabla, mientras que el primer índice independiente muestra una ventaja sobre Luna más pequeña, pero real.

Puntos clave

  • Los prompts de hasta 100,000 tokens cuestan US$0.10 de entrada y US$0.50 de salida por millón de tokens, frente a US$1 y US$5 en Haiku 4.5. Los prompts más largos cuestan US$0.50 y US$2.50, solo 50% menos, según la documentación de precios de Anthropic al 9 de octubre de 2026.
  • Haiku 5.5 cuenta el mismo texto como cerca de 30% más tokens, así que Anthropic estima el ahorro real en alrededor de 75% en promedio, no 90%.
  • Anthropic reporta 72.4% en el subconjunto offline de OSWorld 2.1, frente a 15.7% de Haiku 4.5 y 48.9% de GPT-6 Luna. Son cifras de Anthropic; de forma independiente, Artificial Analysis le da a Haiku 5.5 un 43 y a Luna un 38 en su índice con esfuerzo máximo.
  • Es el primer Haiku con niveles de esfuerzo ajustables, de bajo a máximo, con medio como predeterminado.
  • Ese mismo día, las lecturas de caché de Sonnet 5.5 bajaron a la mitad, a US$0.10 por millón de tokens. Anthropic sigue recomendando Sonnet y Opus para programación agéntica compleja.

Qué significa el precio de Claude Haiku 5.5 frente a Haiku 4.5 y GPT-6 Luna

La página de precios de Anthropic lista dos juegos de precios para Haiku 5.5, separados por la longitud del prompt. Todas las cifras están en dólares estadounidenses por millón de tokens, según la lista del 9 de octubre de 2026; la columna de GPT-6 Luna sale de la ficha del modelo de OpenAI.

ConceptoHaiku 4.5Haiku 5.5, prompts de hasta 100KHaiku 5.5, prompts de más de 100KGPT-6 Luna
EntradaUS$1US$0.10US$0.50US$0.10
SalidaUS$5US$0.50US$2.50US$0.50
Escritura de caché (5 minutos)US$1.25US$0.125US$0.625US$0.125
Lectura de cachéUS$0.10US$0.01US$0.05US$0.01
Entrada / salida por lotesUS$0.50 / US$2.50US$0.05 / US$0.25US$0.25 / US$1.25US$0.05 / US$0.25

Este es nuestro cálculo a precios de lista para un trabajo que envía 10 millones de tokens de entrada y recibe 2 millones de tokens de salida, con todos los prompts por debajo de 100,000 tokens: US$20 en Haiku 4.5, US$2 en Haiku 5.5, US$2 en GPT-6 Luna y US$40 en Sonnet 5.5.

Esos US$2 necesitan una corrección. La ficha del modelo de Anthropic dice que Haiku 5.5 usa un tokenizador más nuevo que convierte el mismo texto en cerca de 30% más tokens que Haiku 4.5. Si tu trabajo crece a 13 millones de tokens de entrada y 2.6 millones de salida, cuesta US$2.60, todavía cerca de 87% menos que en Haiku 4.5. El anuncio de Anthropic pone el ahorro promedio más abajo: "En promedio, ahora cuesta alrededor de 75% menos usarlo".

La trampa de los 100,000 tokens

La tarifa alta se aplica a toda la solicitud en cuanto su prompt pasa de 100,000 tokens, y la página de precios aclara que las lecturas y escrituras de caché cuentan para ese total. Anthropic dice que 90% de las solicitudes a Haiku 4.5 quedaban por debajo de esa línea.

Si todos los prompts de ese mismo trabajo pasaran de 100,000 tokens, costaría US$10 en Haiku 5.5, la mitad de los US$20 de Haiku 4.5. GPT-6 Luna mantiene su precio base hasta 272,000 tokens de entrada, así que en ese rango cuesta una quinta parte que Haiku 5.5 por token. Por encima de 272,000, OpenAI cobra el doble en la entrada y 1.5 veces en la salida, lo que deja el mismo trabajo en US$3.50. Las dos empresas cuentan los tokens de forma distinta, así que comparar por token entre ellas es solo un punto de partida.

Benchmarks de Claude Haiku 5.5: de quién es cada cifra

Todos los resultados de abajo salen de la tabla de lanzamiento de Anthropic. La página no dice con qué nivel de esfuerzo se obtuvieron los resultados de Haiku 5.5 ni quién corrió cada prueba, y remite a la ficha de sistema para los métodos. VentureBeat informa que el resultado de Terminal-Bench fue con esfuerzo máximo y que con esfuerzo medio ronda el 20%.

Benchmark (tabla de Anthropic)Haiku 5.5Haiku 4.5GPT-6 LunaSonnet 5.5
GDPval-AA v2.1 (trabajo de conocimiento, Elo)162073514371840
AA-Briefcase v1.1 (trabajo de conocimiento)157861413361824
OSWorld 2.1, subconjunto offline (uso de computadora)72.4%15.7%48.9%83.9%
Humanity's Last Exam, sin herramientas45.9%10.2%Sin dato56.9%
Humanity's Last Exam, con herramientas57.4%18.7%Sin dato64.5%
Terminal-Bench 4.0 (programación agéntica)39.2%0.0%16.4%70.6%
FrontierCode 1.1 (programación agéntica)46.4%Sin dato42.4%52.1% (esfuerzo xhigh)
Chartography, sin herramientas (razonamiento visual)46.4%6.4%29.1%61.6%

Con las cifras de Anthropic, Haiku 5.5 supera a GPT-6 Luna en todos los resultados listados para ambos y queda detrás de Sonnet 5.5 en todos. La mayor distancia con Sonnet está en la programación agéntica en una terminal: 39.2% contra 70.6%.

El resultado de Sonnet 5.5 en OSWorld aquí, 83.9%, no coincide con el 80.1% de su propia tabla de lanzamiento. Este está marcado como subconjunto offline, así que nuestra lectura es que se trata de una parte distinta de la prueba, aunque Anthropic no lo dice.

Qué muestran por ahora las pruebas independientes

Artificial Analysis, que corre sus propias evaluaciones, le da a Haiku 5.5 un 43 en su Intelligence Index v4.3.2 con esfuerzo máximo y un 34 con el esfuerzo medio predeterminado, al 9 de octubre de 2026. Su página de GPT-6 Luna muestra 38 con esfuerzo máximo y 30 con medio. Eso respalda la dirección de lo que afirma Anthropic, con un margen menor del que sugiere la tabla de lanzamiento. Sonnet 5.5 obtiene 56 en el mismo índice.

La velocidad es la ventaja más clara: Artificial Analysis midió a Haiku 5.5 entre 166 y 240 tokens de salida por segundo según el nivel de esfuerzo, frente a 115 a 128 en las variantes de Luna que cronometró. Aun así, la ejecución más barata por tarea es de Luna: US$0.0045 por tarea del índice con esfuerzo bajo, contra US$0.02 de Haiku 5.5 con esfuerzo bajo.

Haiku 5.5 vs Sonnet 5.5: cuándo elegir cada uno

Anthropic presenta Haiku 5.5 para trabajo de alto volumen y sensible al costo: resúmenes, clasificación, consultas a bases de datos, subagentes que trabajan bajo Sonnet u Opus, atención al cliente en vivo y uso del navegador. Su propia página dice que Sonnet 5.5 y Opus 5.5 siguen siendo mejores en programación agéntica compleja.

Sonnet 5.5 también se abarató el 7 de octubre. Sus lecturas de caché bajaron de US$0.20 a US$0.10 por millón de tokens, lo que según Anthropic reduce su costo en la mayoría de las tareas agénticas en cerca de 20%. Eso no cambia su precio base de US$2 y US$10, 20 veces la tarifa de Haiku 5.5 para prompts cortos. Mira cómo se compara Opus 5.5 si necesitas el nivel más alto.

Haiku 5.5 tiene más sentido cuando:

  • Tus prompts se quedan por debajo de 100,000 tokens, que es donde aplica el recorte de 90%.
  • La velocidad importa, como en el soporte por chat o en las tareas secundarias rápidas de un agente.
  • La tarea es acotada: enrutar, extraer o etiquetar, donde el razonamiento extra de Sonnet no se aprovecha.

Elige Sonnet 5.5 para sesiones largas de programación en una terminal, donde la propia tabla de Anthropic muestra la mayor diferencia. Si estás eligiendo entre modelos económicos, nuestro análisis de GPT-6 Luna cubre el lado de OpenAI.

Qué cambia si pasas de Haiku 4.5

El ID del modelo es claude-haiku-5-5 en la API de Claude, Google Cloud, Microsoft Foundry y Claude Platform on AWS, y anthropic.claude-haiku-5-5 en Amazon Bedrock. Tiene una ventana de contexto de 1 millón de tokens y hasta 128,000 tokens de salida, y Anthropic se compromete a mantenerlo disponible al menos hasta el 7 de octubre de 2027.

La guía de migración enumera los cambios en el código. Los presupuestos de razonamiento fijados con budget_tokens devuelven un error; ahora el razonamiento se controla con el ajuste de esfuerzo. Los valores no predeterminados de temperature, top_p y top_k se rechazan, igual que prellenar la respuesta del asistente. Priority Tier no está disponible en Haiku 5.5, y hay que revisar el conteo de tokens y los límites de max_tokens por el nuevo tokenizador.

En resumen

Claude Haiku 5.5 es cerca de 90% más barato por token que Haiku 4.5 en prompts de hasta 100,000 tokens, empata ahí con el precio de lista de GPT-6 Luna y cuesta cinco veces la tarifa por token de Luna entre 100,000 y 272,000 tokens. Su ventaja sobre Luna en benchmarks es una afirmación de la propia Anthropic, y Artificial Analysis confirma una más pequeña, además de una clara ventaja en velocidad. Si usas Haiku 4.5, cámbiate después de volver a contar tokens y corregir los cambios incompatibles. Si tu trabajo es programación difícil, Sonnet 5.5 sigue siendo la opción. Hay más cobertura en nuestra sección de IA.

Preguntas frecuentes

¿Cuánto cuesta Claude Haiku 5.5?

El precio de Claude Haiku 5.5 en la API de Claude es de US$0.10 por millón de tokens de entrada y US$0.50 por millón de tokens de salida para prompts de hasta 100,000 tokens, y de US$0.50 y US$2.50 para prompts más largos, al 9 de octubre de 2026. Las lecturas de caché cuestan US$0.01 o US$0.05 por millón, y la API por lotes reduce a la mitad los precios de entrada y salida.

¿Claude Haiku 5.5 es mejor que GPT-6 Luna?

En la tabla de la propia Anthropic, Haiku 5.5 supera a Luna en los seis resultados listados para ambos. En el índice independiente de Artificial Analysis obtiene 43 contra 38 de Luna con esfuerzo máximo y es más rápido, pero el ajuste más barato de Luna cuesta menos por tarea.

¿Qué son los niveles de esfuerzo en Claude Haiku 5.5?

El esfuerzo es un ajuste que le indica al modelo cuánto pensar antes de responder. Haiku 5.5 ofrece bajo, medio, alto, xhigh y máximo, con medio como predeterminado en la API. Un esfuerzo más alto suele dar mejores resultados y usa más tokens.

Archivado en IA

Boletín

Guías de consolas y celulares, por correo.

Soluciones, ajustes y decisiones de compra para la consola y el celular que tienes, de las guías que publicamos. Gratis. Cancela con un clic. Tu correo lo guarda beehiiv, nuestro servicio de boletines, y solo se usa para este boletín.