Anthropic ha lanzado Claude Haiku 5.5, su modelo pequeño más barato y rápido hasta la fecha. Se centra en trabajos de gran volumen, como los resúmenes, la compactación, la clasificación y las tareas de subagentes. Mantiene una ventana de contexto de 1 millón de fichas y hasta 128 000 fichas de salida. Los precios comienzan en 0,10 USD por millón de fichas de entrada y 0,50 USD por millón de fichas de salida. Esta cifra es un 90% inferior a la de Claude Haiku 4.5 para conseguir hasta 100 000 fichas.
¿Es desplegable? Sí, como API alojada. Haiku 5.5 está disponible de forma general en la API Claude, Amazon Bedrock, Google Cloud, Microsoft Foundry y Claude Platform
en AWS.¿Qué envió Anthropic
ElHaiku 5.5 es el primer modelo de la clase Haiku con un ajuste de esfuerzo ajustable.
El pensamiento adaptativo está activado de forma predeterminada y el parámetro de esfuerzo está predeterminado en medio.
Toma texto e imágenes, genera texto y tiene un límite de conocimiento para junio de 2026. Los trabajos por lotes admiten hasta 300 000 tokens de salida
en versión beta.Es importante tener en cuenta dos cosas clave. Los valores de temperatura, top_p o no predeterminados arrojan un error de 400. El nuevo tokenizador también cuenta con el mismo texto, aproximadamente un 30% más de fichas que Haiku 4.5. La guía de migración cubre ambos aspectostop_k
Precios: una estructura de 2 niveles
Los precios se dividen en 100 000 fichas rápidas. Hasta 100 000, la entrada cuesta 0,10 USD y la salida 0,50 USD por millón. Las lecturas en caché cuestan 0,01 USD y las escrituras en caché de 5 minutos, 125 USD. Por encima de los 100 000$, las tarifas suben a 0,50$ de entrada y 2,50$
de salida.El Haiku 4.5 cobraba 1 dólar por entrada y 5 dólares por salida. Anthropic afirma que alrededor del 90% de las solicitudes de Haiku 4.5 se quedaron por debajo de los 100.000 tokens. Tras ajustar el tokenizador, estima que Haiku 5.5 es de media un 75% más barato. El procesamiento por lotes conlleva otro 50%
de descuento.El GPT-6 Luna muestra velocidades idénticas en contextos cortos. Su nivel superior comienza solo por encima de 272 000 fichas de entrada, con un precio de 0,20 y 0,75 USD. Para una oferta de 150 000 fichas, Luna es más barata
en su precio de lista.Puntos de referencia
Todas las cifras que figuran a continuación provienen de Anthropic (consulte la tarjeta del sistema):
- OSWorld 2.1 (subconjunto offline): 72,4%, frente al 48,9% de GPT-6 Luna y el 15,7% de Haiku 4.5.
- Terminal-Bench 4.0: 39,2%, frente al 16,4% de Luna y el 0,0% de Haiku 4.5.
- FrontierCode 1.1 (principal): 46,4%, frente al 42,4% de Luna.
- El último examen de la humanidad: el 45,9% sin herramientas y el 57,4% con herramientas.
- GDPVal-AA v2.1: 1620, frente a 1437 de Luna y 735 de Haiku 4.5.
El Sonnet 5.5 sigue liderando todas las filas, incluido un 70,6% en Terminal-Bench 4.0. La propia Anthropic recomienda Sonnet 5.5 y Opus 5.5
para la codificación de agentes compleja.Mejores casos de uso
Tres cargas de trabajo son las que mejor se adaptan a Haiku 5.5:
- El primero es el trabajo con subagentes en Opus 5.5 o Sonnet 5.5. En Rogo, un subagente de Haiku 5.5 genera una línea de ingresos de 10 000 dólares, mientras que un modelo más grande construye la baraja.
- El segundo es el resumen y las preguntas y respuestas de documentos de gran volumen. AlphaSense lo probó con una función que gestionaba alrededor de 8 millones de llamadas a la semana.
- El tercero es un trabajo que depende de la velocidad, como la atención al cliente en vivo y el uso del navegador.
Haiku 5.5 frente a sus competidores más cercanos
| Cuenta con | Claude Haiku 5.5 | GPT-6 Luna | Gemini 3.5 Flash-Lite Entrada/salida (por 1 millón): 0,10 | |
|---|---|---|---|---|
| dólares/0,50 dólares | | 0,10 dólares/0,30 dólares/2,50 US$ | Precios rápidos | 0,50US$/2,50$ por |
| 100 000 0,20$/0,75$ por encima de 272 000 lentas | lentas de | |||
| caché leídas ( | fichas | |||
| 1 048 576 fichas Salida máxima | | |||
| 128 000 fichas | 128 000 fichas | 65 536 fichas | ||
| Entradas | Texto, imágenes Texto, imágenes | Texto, | imagen, vídeo, audio, PDF | |
| Control de razonamiento | Pensamiento adaptativo + esfuerzo (medio predeterminado) | Razonamiento. Esfuerzo ninguno al máximo (medio predeterminado) | Pensamiento compatible con | |
| uso del ordenador | Soporte del SDK en versión beta | Compatible (API de respuestas) | Compatible (vista previa) | |
| Descuento por lotes | 50% | 50% (por lotes y Flex) | Límite de conocimiento | del 50%|
| junio de 2026 | 18 de mayo de 2026 | No aparece en la página modelo | ||
| Dónde ejecutar | laAPI Claude, Bedrock, Google Cloud, Microsoft Foundry y Claude Platform en la API Gemini de AWS | OpenAI | API |
Fuentes: documentos de Anthropic, anuncio de Anthropic, página modelo de OpenAI, precios de OpenAI, página modelo de Google, precios de Google . Precios de lista de nivel estándar, verificados el 7 de octubre de 2026
.Explicador interactivo
&Conclusiones clave
- Entrada de 0,10 USD y salida de 0,50 USD por cada 1 millón de fichas para solicitudes de hasta 100 000 fichas.
1 millón de contexto, 128 000 de salida, pensamiento adaptativo con un ajuste de esfuerzo (medio predeterminado).- El 72,4% en OSWorld 2.1 frente al 15,7% en Haiku 4.5 (según datos de Anthropic).
- El mismo precio de lista en contexto breve que el GPT-6 Luna; Luna es más barato por encima de los 100 000 tokens.
- Posicionado como subagente en Opus 5.5 y Sonnet 5.5, no como líder de codificación.
Consulta los detalles técnicos. Todo el mérito es para el investigador de este proyecto. Además, siéntete libre de seguirnos en Twitter y no olvides unirte a nuestro subReddit de más de 150 000 ml y suscribirte a nuestro boletín. ¡Espera! ¿Estás en Telegram? ahora también puedes unirte a nosotros en Telegram.
gratuitas.The post Anthropic lanza Claude Haiku 5.5: Un modelo pequeño con un contexto de 1 millón de dólares con un precio de 0,10 dólares por millón de fichas de entrada appeared first on MarkTechPost.