Por Canuto  

Anthropic presentó Claude Haiku 5.5 como su modelo más rápido y económico de la familia, con tarifas hasta 90% menores para prompts de hasta 100.000 tokens. La compañía lo orienta a cargas de trabajo frecuentes, agentes y atención al cliente, mientras también rebaja las lecturas de caché de Sonnet 5.5 y ofrece créditos de API a suscriptores.
***

  • Anthropic afirma que Haiku 5.5 cuesta en promedio alrededor de 75% menos que Haiku 4.5; para prompts de hasta 100.000 tokens, la reducción tarifaria llega a 90%.
  • El modelo mejora frente a Haiku 4.5 en las pruebas publicadas, aunque Sonnet 5.5 conserva mejores resultados en programación agéntica y otros benchmarks.
  • La empresa también reduce 50% el precio de las lecturas de caché de Sonnet 5.5 y anuncia créditos mensuales de API para suscriptores Max y Team.

 


Un modelo pensado para tareas frecuentes

Anthropic presentó Claude Haiku 5.5, un modelo que describe como el más rápido, económico y capaz de su categoría dentro de su oferta hasta la fecha. La compañía lo enfoca en trabajos repetitivos y de alto volumen, como resumir documentos, compactar información, consultar bases de datos y clasificar solicitudes, ámbitos donde una tarifa menor puede importar tanto como la calidad de cada respuesta, informó la compañía en su blog oficial.

La empresa también plantea que Haiku 5.5 puede funcionar como subagente junto a Sonnet 5.5 y Opus 5.5 en procesos de programación. En ese esquema, el modelo más pequeño atendería tareas acotadas mientras uno más potente conduce el trabajo general, una combinación que Anthropic presenta como una vía para controlar costos sin renunciar a capacidades avanzadas en cada etapa.

La velocidad es otro de los argumentos de lanzamiento. Anthropic afirma que Haiku 5.5 es su modelo más rápido bajo la velocidad estándar de cada producto, y destaca su posible utilidad en atención al cliente en vivo y navegación web, aunque aclara que no supera a sus modelos Opus cuando estos se ejecutan en Fast Mode.

El lanzamiento busca cubrir un tipo de uso distinto al de los modelos más grandes, no reemplazarlos en todos los escenarios. Anthropic señala que Sonnet 5.5 y Opus 5.5 siguen siendo opciones mejores para tareas complejas de programación agéntica, mientras que Haiku 5.5 resulta más apropiado para encargos delimitados que podrían ser demasiado costosos si se ejecutaran repetidamente con modelos de mayor tamaño.

Precios, tarifas y comparación de rendimiento

Anthropic afirma que Haiku 5.5 cuesta, en promedio, alrededor de 75% menos que Haiku 4.5. La diferencia depende del tamaño de la solicitud: para prompts de hasta 100.000 tokens, la compañía calcula una reducción de precio de 90%, mientras que para solicitudes superiores a ese umbral la rebaja es de 50%; alrededor de 90% de las solicitudes a Haiku 4.5 pertenecían al primer grupo.

Por cada millón de tokens de entrada, Haiku 5.5 cuesta USD $0,10 para prompts de hasta 100.000 tokens y USD $0,50 para los más largos; los tokens de salida cuestan USD $0,50 y USD $2,50, respectivamente. Las lecturas de caché se fijan en USD $0,01 o USD $0,05, y las escrituras en USD $0,125 o USD $0,625, según el tamaño del prompt.

La comparación publicada sitúa esas tarifas por debajo de las de Haiku 4.5, que cobra USD $1 por millón de tokens de entrada y USD $5 por millón de salida, además de USD $0,10 por lecturas de caché y USD $1,25 por escrituras. Anthropic advierte que su cálculo de ahorro considera también el cambio de tokenizador: Haiku 5.5 puede emplear ligeramente más tokens para completar una tarea, por lo que la reducción efectiva no equivale siempre a comparar solo los precios unitarios.

En los benchmarks divulgados, Haiku 5.5 obtuvo 1.620 puntos en GDPval-AA v2.1 y 1.578 en AA-Briefcase v1.1, pruebas de trabajo de conocimiento, frente a 735 y 614 de Haiku 4.5. En OSWorld 2.1, un benchmark de uso de computadora, logró 72,4%, comparado con 15,7% de su antecesor; Sonnet 5.5 encabezó esos resultados con 1.840, 1.824 y 83,9%, respectivamente.

Pruebas de razonamiento, programación y clientes

Anthropic reportó 45,9% para Haiku 5.5 en Humanity’s Last Exam sin herramientas y 57,4% con herramientas, frente a 10,2% y 18,7% de Haiku 4.5. Sonnet 5.5 registró 56,9% y 64,5% en esas mismas modalidades; la tabla no incluye un resultado para GPT-6 Luna en esa prueba, por lo que no corresponde inferir una comparación allí.

En programación agéntica, Haiku 5.5 alcanzó 39,2% en Terminal-Bench 4.0, mientras Haiku 4.5 obtuvo 0% y Sonnet 5.5 llegó a 70,6%. En FrontierCode 1.1 Main, el nuevo Haiku registró 46,4%, por encima del 42,4% de GPT-6 Luna, pero por debajo del 52,1% de Sonnet 5.5 en la configuración Xhigh que consigna la tabla.

El modelo también consiguió 46,4% en la prueba de razonamiento visual Chartography, frente a 6,4% de Haiku 4.5 y 61,6% de Sonnet 5.5. Anthropic precisa que OSWorld mide la capacidad de operar una computadora real para cumplir tareas de varios pasos, GDPval-AA examina trabajo profesional en 44 ocupaciones y Humanity’s Last Exam evalúa conocimientos académicos y razonamiento de nivel experto.

Las empresas citadas por Anthropic compartieron evaluaciones propias, que no equivalen a una auditoría independiente. Asana dijo que observó una reducción de latencia superior a 30% al completar tareas y hasta 2,5 veces más velocidad de inferencia por turno de agente; HubSpot reportó 92,8% de acierto promedio en tres ejecuciones de tareas de CRM, además de destacar rapidez y menor tasa de falsos positivos en una auditoría de registros ambiguos.

Aplicaciones empresariales y nuevas herramientas

AlphaSense explicó que probó 400 consultas de su producto Ask in Document, que realiza cerca de ocho millones de llamadas semanales en producción, y comunicó una mejora estadísticamente significativa frente a Haiku 4.5: una puntuación de 0,84, frente a 0,76. La empresa indicó que el producto responde preguntas específicas sobre uno o varios documentos, un uso que podría beneficiarse de un modelo económico en operaciones frecuentes.

Box, por su parte, señaló que Haiku 5.5 obtuvo 11 puntos más que Haiku 4.5 en sus pruebas tempranas y alrededor de la mitad de latencia. Su vicepresidenta de Productos de IA, Yashodha Bhavnani, mencionó como usos posibles los análisis ejecutados a gran escala, incluidos reportes de costos, resúmenes financieros y revisiones semanales recurrentes.

Rogo destacó el uso del modelo en búsquedas rápidas, resúmenes y subagentes que extraen datos puntuales de documentos extensos, mientras un modelo mayor se ocupa de tareas más amplias, como construir una presentación. Cognition informó que, al incorporarlo como asistente secundario de Devin Fusion, el sistema mantuvo una puntuación FrontierCode de 66,2 y redujo costo y latencia; también indicó que se puede probar en Devin CLI con Opus 5.5 como modelo líder.

La disponibilidad abarca Claude Platform y los servicios de Amazon Web Services, Google Cloud y Microsoft Azure. En la plataforma de Anthropic, los desarrolladores pueden iniciar con el identificador claude-haiku-5-5, y la empresa añadió soporte beta para uso de computadora y navegación web en sus SDK de Python y TypeScript, tareas para las que considera que la combinación de rapidez, capacidad y precio puede resultar pertinente.

Recortes para Sonnet, créditos y salvaguardas

Junto con Haiku 5.5, Anthropic redujo a la mitad el precio de las lecturas de caché de Sonnet 5.5, que pasó de USD $0,20 a USD $0,10 por millón de tokens. La compañía estima que ese cambio abarata alrededor de 20% la mayoría de los trabajos agénticos con Sonnet, porque las lecturas de caché representan una parte importante del consumo de tokens.

La empresa también anunció créditos mensuales de API para suscriptores de Claude Max y Team que quieran crear herramientas, aplicaciones y agentes en Claude Platform. Los usuarios de Max 5x recibirán USD $100 al mes y los de Max 20x, USD $200; los equipos obtendrán hasta USD $500, compartidos entre sus usuarios, y los créditos podrán utilizarse con cualquiera de los modelos de Anthropic.

En materia de seguridad, Anthropic sostiene que Haiku 5.5 mejora en casi todas sus evaluaciones de alineación frente a Haiku 4.5, con menos comportamientos desalineados y menor disposición a cooperar con usos indebidos. La empresa indica que sus salvaguardas de ciberseguridad son más restrictivas que las de Haiku 4.5, aunque algo menos que las aplicadas a otros modelos recientes: permiten más tareas defensivas que las barreras de Sonnet 5.5, pero bloquean pruebas de penetración y técnicas con mayor posibilidad de uso por atacantes.

Para biología, las salvaguardas coinciden con las de Sonnet 5, Sonnet 5.5 y Opus 5, según la compañía: permiten preguntas de investigación, pero restringen solicitudes que Anthropic juzga capaces de causar daño. Las organizaciones dedicadas a actividades biológicas o cibernéticas de mayor alcance pueden solicitar acceso a los programas de verificación de ciencias biológicas y ciberseguridad de la empresa, que ofrece más detalles sobre sus evaluaciones en la tarjeta de sistema del modelo.


Imagen original de DiarioBitcoin, creada con inteligencia artificial, de uso libre, licenciada bajo Dominio Público.

Este artículo fue escrito por un redactor de contenido de IA y revisado por un editor humano para garantizar calidad y precisión.


ADVERTENCIA: DiarioBitcoin ofrece contenido informativo y educativo sobre diversos temas, incluyendo criptomonedas, IA, tecnología y regulaciones. No brindamos asesoramiento financiero. Las inversiones en criptoactivos son de alto riesgo y pueden no ser adecuadas para todos. Investigue, consulte a un experto y verifique la legislación aplicable antes de invertir. Podría perder todo su capital.

Suscríbete a nuestro boletín