MIÉRCOLES 7 DE OCTUBRE DE 2026 · ROSARIO, SANTA FE
Radar activo Agenda Newsletter Opinión
Lito, mascota de MonoLitoMonolito
Sumate
Último momento
CIENCIANobel de Química 2026 para Henri Kagan y Kenso Soai, que resolvieron el misterio de la química del espejo NEGImpulso 360, el encuentro de tecnología y negocios, llega a la Tecnoteca CIENCIANobel de Física 2026 para Francis Halzen, explicado por científicos del CONICET que trabajaron con él GAMINGKiosco Simulator, el juego argentino del turno noche en un kiosco del conurbano, ya tiene página en Steam GAMINGGame Pass pierde nueve juegos el 15 de octubre, entre ellos Clair Obscur: Expedition 33 AUDIOVISUALEl Planetario de Rosario se convierte en estudio de arte inmersivo: llega Micelia 360° y abre una formación gratuita IAMarca de agua invisible: OpenAI marcará los textos de ChatGPT y Codex en la Unión Europea GAMINGGears of War: E-Day sale hoy en Xbox y PC: Game Pass, precio y qué trae CIENCIANobel de Química 2026 para Henri Kagan y Kenso Soai, que resolvieron el misterio de la química del espejo NEGImpulso 360, el encuentro de tecnología y negocios, llega a la Tecnoteca CIENCIANobel de Física 2026 para Francis Halzen, explicado por científicos del CONICET que trabajaron con él GAMINGKiosco Simulator, el juego argentino del turno noche en un kiosco del conurbano, ya tiene página en Steam GAMINGGame Pass pierde nueve juegos el 15 de octubre, entre ellos Clair Obscur: Expedition 33 AUDIOVISUALEl Planetario de Rosario se convierte en estudio de arte inmersivo: llega Micelia 360° y abre una formación gratuita IAMarca de agua invisible: OpenAI marcará los textos de ChatGPT y Codex en la Unión Europea GAMINGGears of War: E-Day sale hoy en Xbox y PC: Game Pass, precio y qué trae
← Volver a la portada
Inteligencia Artificial

Anthropic lanzó Claude Sonnet 5.5, más rápido y más barato por tarea, un día antes del DevDay de OpenAI

El nuevo modelo pasó de 10,3% a 70,6% en Terminal-Bench 4.0, una prueba de programación con agentes, y en ese examen superó a Opus 5.5. Cuesta lo mismo que Sonnet 5, USD 2 y USD 10 por millón de tokens, pero gasta hasta 30% menos por tarea.

Sebastián Villalba Viña septiembre 29, 2026 4 min de lectura
Inteligencia ArtificialIA

El nuevo modelo pasó de 10,3% a 70,6% en Terminal-Bench 4.0, una prueba de programación con agentes, y en ese examen superó a Opus 5.5. Cuesta lo mismo que Sonnet 5, USD 2 y USD 10 por millón de tokens, pero gasta hasta 30% menos por tarea.

Anthropic presentó el lunes 28 de septiembre Claude Sonnet 5.5, el segundo modelo de su familia Claude 5.5. Según la empresa, genera respuestas más de un 30% más rápido que Claude Sonnet 5 y, en la mayoría de los trabajos, cuesta hasta un 30% menos por tarea. El lanzamiento llegó un día antes del DevDay de OpenAI, que se hace el martes 29 de septiembre en San Francisco, con una keynote de apertura de Sam Altman a las 10 de la mañana del Pacífico (14 de la Argentina).

La compañía lo presenta como un complemento más rápido y barato de Claude Opus 5.5: Opus queda para el trabajo complejo que exige juicio cuidadoso y Sonnet 5.5, para tareas cotidianas bien acotadas, corregir errores de código y armar documentos, presentaciones y planillas. Haiku 5.5, pensado para usos masivos y sensibles al costo, se sumará a la familia en las próximas semanas.

Qué es Terminal-Bench y por qué importa el salto

Un benchmark es un examen estandarizado: el mismo conjunto de tareas se le toma a todos los modelos para poder compararlos con la misma vara. Terminal-Bench 4.0, en palabras de Anthropic, mide qué tan bien un modelo completa tareas profesionales complejas y de varios pasos dentro de una interfaz de línea de comandos, la terminal que usan los programadores. Es una evaluación de programación «agéntica»: la IA no responde una pregunta, sino que trabaja por su cuenta, paso a paso, hasta terminar la tarea.

En esa prueba, Sonnet 5.5 obtuvo 70,6%, contra 10,3% de Sonnet 5. También quedó por encima de Opus 5.5, que marcó 66,4% en su nivel de esfuerzo más alto (Xhigh), el de su mejor resultado.

El salto se repite en otras mediciones que publicó la empresa. En CursorBench 4.0, que evalúa agentes de programación con tareas ambiguas tomadas de sesiones reales de Cursor, pasó de 34,1% a 55,5%. En OSWorld 2.1, de uso de la computadora, de 57,0% a 80,1%. En Humanity’s Last Exam, de razonamiento multidisciplinario con herramientas, de 54,9% a 64,5%. Y en Chartography, de lectura de gráficos sin herramientas, de 15,6% a 61,6%.

Cerca de Opus, pero no igual

En varias pruebas Sonnet 5.5 queda a pocos puntos del modelo más caro. En GDPval-AA v2.1, que mide trabajo real en 44 ocupaciones de nueve grandes industrias, sacó 1844 puntos contra 1846 de Opus 5.5 y 1449 de Sonnet 5. En AA-Briefcase v1.1, de trabajo de oficina de largo aliento, 1811 contra 1822. En OSWorld 2.1, 80,1% contra 81,8%, y en CursorBench 4.0, 55,5% contra 57,8%.

La propia Anthropic pone un límite a la comparación: aclara que los benchmarks captan solo una faceta de lo que puede hacer un modelo y que, en sus pruebas y en las de evaluadores externos, Opus 5.5 «sigue siendo claramente más fuerte» en el trabajo complejo y abierto que exige juicio sostenido.

Precio y velocidad

Sonnet 5.5 mantiene el precio de Sonnet 5: USD 2 por millón de tokens de entrada, USD 10 por millón de tokens de salida, USD 0,20 por millón en lecturas de caché y USD 2,50 en escrituras de caché. Opus 5.5 cuesta el doble en entrada y salida (USD 4 y USD 20). La diferencia, según la empresa, está en que el nuevo modelo necesita muchos menos tokens para hacer el mismo trabajo, y por eso cada tarea sale hasta un 30% más barata.

Las empresas que lo probaron antes del lanzamiento reportaron números en la misma línea. Slack indicó que mejoró en casi todas sus evaluaciones internas con alrededor de 14% menos tokens de salida; Box, que resultó 2,4 veces más rápido y usó 12% menos tokens, y Atlassian, que sus agentes Rovo pueden correr hasta 30% más rápido que con Sonnet 5.

«Los tickets se procesaron un 20% más rápido, y nuestros clientes recibieron la ayuda que necesitan sin esperas», afirmó Abhinay Kathuria, director de IA de Zendesk, en declaraciones difundidas por Anthropic.

Claude Sonnet 5.5 ya está disponible en todas las plataformas de la empresa y en Amazon Web Services, Google Cloud y Microsoft Azure. Para desarrolladores, el identificador en la Claude Platform es claude-sonnet-5-5.

El posteo en Instagram

Ver esta publicación en Instagram