Anthropic lanzó el 7 de octubre de 2026 Claude Haiku 5.5, su modelo más rápido, orientado a tareas de alto volumen y baja latencia como clasificación, enrutamiento, extracción de datos y subagentes. Según la documentación oficial, ofrece una ventana de contexto de 1 millón de tokens y hasta 128K tokens de salida.
Datos clave
- Precio: US$0.10 por millón de tokens de entrada y US$0.50 de salida en prompts de hasta 100K tokens; la API por lotes da 50% de descuento.
- Entrada de texto e imágenes, salida de texto; corte de conocimiento en junio de 2026.
- Razonamiento adaptativo activado por defecto, con parámetro effort para ajustar profundidad.
- Disponible en la API de Claude, Google Cloud, Microsoft Foundry, Amazon Bedrock y Claude Platform on AWS.
En la familia 5.5 es la opción más barata, por debajo de Sonnet 5.5 (US$2/US$10), Opus 5.5 (US$4/US$20) y Fable 5.1 (US$10/US$50). La documentación advierte que el nuevo tokenizador usa alrededor de 30% más tokens que Haiku 4.5 para el mismo texto, y que no se deben enviar temperature, top_p ni top_k.
Por qué interesa a las empresas
Modelos pequeños y baratos hacen viable clasificar cada ticket, correo o conversación y enrutarlo a la cola correcta en tiempo real, algo valioso en mesas de ayuda y centros de contacto. Fuente: documentación de Claude Haiku 5.5.
En TEKFENIX aplicamos esta idea en Servigo365, con clasificación y atención multicanal asistida por IA, y en Nexturno, para orientar turnos y colas en sucursales según la demanda.