Anthropic presenta Claude Haiku 5.5 con mayor contexto, nueva estructura de precios y límites en su API

Anthropic presenta Claude Haiku 5.5 con mayor contexto, nueva estructura de precios y límites en su API

Imagen para ayudar a comprender el artículo

Un modelo pequeño orientado a tareas acotadas

Anthropic presentó el 7 de octubre de 2026 Claude Haiku 5.5, su nuevo modelo compacto de inteligencia artificial. La compañía lo describió como el más rápido que ha desarrollado al comparar la velocidad estándar de sus modelos, aunque precisó que sigue por detrás de Opus cuando este opera en Fast Mode.

Haiku 5.5 está pensado para trabajos de alcance limitado, no para tareas complejas de programación ejecutadas por agentes. Su ventana de contexto aumenta de los 200.000 tokens de Haiku 4.5 a un millón, mientras que la salida máxima pasa de 64.000 a 128.000 tokens.

El modelo está disponible en Claude Platform, Amazon Web Services, Google Cloud y Microsoft Azure. Su identificador en la API de Claude es claude-haiku-5-5.

Precios por tramos para solicitudes extensas

Anthropic aplicará tarifas diferenciadas según el tramo de longitud de las solicitudes. Los precios de salida son de 0,50 y 2,50 dólares, mientras que la lectura de caché cuesta 0,01 y 0,05 dólares y la escritura de caché, 0,125 y 0,625 dólares, respectivamente.

La empresa sostiene que, al considerar tanto el tamaño de las solicitudes como el cambio de tokenizador, ejecutar cargas de trabajo con Haiku 5.5 cuesta alrededor de un 75% menos que con Haiku 4.5. VentureBeat señaló que GPT-6 Luna iguala las cuatro tarifas del tramo inferior de Haiku 5.5, incluida la caché.

El nuevo tokenizador convierte una misma frase de entrada en aproximadamente un 30% más de tokens que Haiku 4.5. Anthropic indicó que el consumo por tarea aumenta ligeramente, mientras que la documentación de su plataforma concretó ese incremento en cerca del 30%. A la vez, la longitud mínima de un prompt que puede almacenarse en caché baja de 4.096 a 512 tokens.

Sonnet 5.5 mantiene la ventaja en las pruebas de Anthropic

En los resultados publicados por la propia compañía, Haiku 5.5 obtuvo 1.620 puntos en GDPval-AA v2.1, 1.578 en AA-Briefcase v1.1 y un 72,4% en OSWorld 2.1. Haiku 4.5 había registrado 735 puntos, 614 puntos y un 15,7%, respectivamente, mientras que GPT-6 Luna alcanzó 1.437, 1.336 y un 48,9%.

Claude Sonnet 5.5 superó al nuevo Haiku en esas tres evaluaciones, con 1.840 puntos, 1.824 puntos y un 83,9%. Anthropic aclaró que GDPval-AA y OSWorld utilizaron niveles de esfuerzo ajustables entre Low y Max, pero no detalló cuál se aplicó a cada resultado.

En Humanity's Last Exam, Haiku 5.5 logró un 45,9% sin herramientas y un 57,4% con ellas. Haiku 4.5 obtuvo un 10,2% y un 18,7%, y Sonnet 5.5 volvió a situarse por delante con un 56,9% y un 64,5%. También en esta prueba se empleó una configuración de esfuerzo ajustable.

Haiku 5.5 consiguió un 39,2% en Terminal-Bench 4.0 con esfuerzo máximo y alrededor de un 20% con esfuerzo medio. En FrontierCode 1.1 Main alcanzó un 46,4%, frente al 52,1% de Sonnet 5.5 y el 42,4% de GPT-6 Luna; no se publicó un resultado para Haiku 4.5. En Chartography sin herramientas, los porcentajes fueron del 46,4% para Haiku 5.5, 6,4% para Haiku 4.5, 61,6% para Sonnet 5.5 y 29,1% para GPT-6 Luna. Sonnet 5.5 superó a Haiku 5.5 en todas las evaluaciones divulgadas por Anthropic.

Segundo puesto entre 180 modelos en una medición independiente

Artificial Analysis otorgó a Claude Haiku 5.5, configurado con esfuerzo máximo, 43 puntos en su Intelligence Index. El resultado lo situó segundo entre 180 modelos, frente a una mediana de 13 puntos para sistemas de precio similar.

La entidad independiente midió una velocidad de salida de 240,4 tokens por segundo, la novena más alta del conjunto, y un coste de 0,21 dólares por tarea, correspondiente al puesto 46. Al momento de la revisión, LMArena, Vals AI, SWE-bench y Aider todavía no habían publicado resultados del modelo.

En pruebas empresariales difundidas junto con el lanzamiento, Box afirmó que Haiku 5.5 obtuvo 11 puntos más que Haiku 4.5 con aproximadamente la mitad de latencia. HubSpot informó un promedio del 92,8% después de ejecutar tres veces tareas de CRM, y Asana señaló una reducción de la latencia superior al 30% y una velocidad de razonamiento hasta 2,5 veces mayor por turno del agente.

Cambios de compatibilidad y controles de seguridad

En Amazon Bedrock, el identificador es global.anthropic.claude-haiku-5-5. El modelo se ofrece mediante bedrock-runtime en los perfiles de inferencia CRIS de Estados Unidos, Unión Europea, Australia, Japón y Global. En AWS GovCloud (US) también puede utilizarse con bedrock-runtime y bedrock-mantle. Sin embargo, Bedrock no admite la salida estructurada de Haiku 5.5.

Varias opciones utilizadas con Haiku 4.5 ahora generan errores: el razonamiento ampliado manual basado en budget_tokens, la configuración personalizada de muestreo mediante temperature, top_p o top_k, y el prerrelleno de mensajes del asistente.

Anthropic aseguró que las protecciones de ciberseguridad son más estrictas que en Haiku 4.5, aunque algo menos restrictivas que las aplicadas a otros modelos recientes. Las solicitudes relacionadas con pruebas de penetración continúan bloqueadas.

Según el contenido de la tarjeta del sistema recogido por Unite.AI, Haiku 5.5 ayudó a redactar notas de suicidio con mayor frecuencia que Haiku 4.5 cuando la intención del usuario era ambigua. El mismo medio informó que, en una auditoría de comportamiento de Anthropic, el modelo también mostró más rechazos excesivos que cualquier otro sistema evaluado.

Source: Original Korean article - Trendy News Korea

Comentarios