Anthropic lanza Claude Opus 5.5 con mayor velocidad, respuestas más concisas y menores costos
Menos de dos meses después de la presentación de Claude Opus 5, Anthropic ha lanzado al mercado su nuevo modelo Claude Opus 5.5, disponible desde hoy. Según ha informado la compañía, esta actualización ofrece un rendimiento equivalente a Fable 5.1 en la mayoría de las tareas, con un costo de ejecución aproximadamente un 40 % menor y una velocidad de generación de respuesta superior al 30 % en comparación con su predecesor.
En el plano económico, los precios de los tokens se han reducido un 20 % respecto a Opus 5, a lo que se suma una mayor eficiencia que requiere menos tokens para realizar trabajos de alta calidad. Para los usuarios con planes de suscripción, la empresa ha incrementado en un 20 % los límites de uso de cinco horas. Debido al menor consumo del modelo, Anthropic calcula que la capacidad efectiva de ejecución aumenta en cerca de un 50 %.
Mejoras en concisión y desarrollo de software
Uno de los cambios destacados en Claude Opus 5.5 es la reducción del texto innecesario en sus respuestas. De acuerdo con Yashodha Bhavnani, vicepresidenta de Productos de IA en Box, sus evaluaciones mostraron que Opus 5.5 utilizó un tercio de los tokens que requería Opus 5 y ofreció respuestas un 40 % menos verborreicas sin perder precisión.
Por su parte, John Ruelas, ingeniero de software en Ramp, indicó que el modelo sigue de forma precisa las reglas de redacción y permite generar especificaciones de diseño funcionales con revisiones mínimas.
El desempeño del nuevo modelo también ha sido evaluado en tareas de programación e ingeniería de software por distintas empresas:
- GitHub: Mario Rodriguez, director de producto de GitHub, señaló que en las pruebas realizadas con GitHub Copilot CLI y VS Code, el modelo requirió menos tokens y pasos. En VS Code logró resolver más tareas de terminal que Opus 5 empleando menos de la mitad de los pasos.
- Deloitte Consulting LLP: Carl Bennett, CIO de la firma, afirmó que en su configuración de menor esfuerzo, Claude Opus 5.5 detectó el 72 % de los errores conocidos en revisiones de código, superando el 56 % registrado por Opus 5 en su nivel de alto esfuerzo.
Controles de seguridad y próximos lanzamientos
Anthropic enfatizó que Claude Opus 5.5 ha superado pruebas de alineación y evaluación previa junto a organizaciones externas. La empresa sostiene que se trata de su modelo con mejor desempeño hasta la fecha en materia de seguridad, mostrando avances en la reducción de razonamientos sesgados y en la prevención de intentos de evasión de entornos aislados (sandboxes).
Para mitigar riesgos, la plataforma cuenta con un mecanismo de resguardo: si se activan las alertas de seguridad, las solicitudes se redirigen automáticamente a versiones anteriores. Las tareas de ciberseguridad se reorientarán a Opus 4.8, mientras que las consultas sobre biología y desarrollo de modelos de lenguaje a gran escala se procesarán con Opus 5.
Las organizaciones evaluadas pueden solicitar acceso al Programa de Verificación de Ciencias de la Vida para investigaciones biológicas. En el caso del Programa de Verificación Cibernética, los usuarios aprobados podrán empezar a utilizar Opus 5.5 en las próximas semanas.
Finalmente, Anthropic confirmó que durante las semanas venideras llevará a cabo el lanzamiento de los modelos Claude Sonnet 5.5 y Claude Haiku 5.5.