Según MarkTechPost (AI/ML News), Anthropic lanzó hoy la versión 5 de su modelo Claude Opus, reemplazando a la versión 4.8 como referencia de gama superior en su línea de productos. La oferta se mantiene sin variaciones: 5 dólares por millón de tokens de entrada y 25 dólares por millón de tokens de salida. La empresa posiciona a Opus 5 como una herramienta que alcanza niveles de inteligencia comparables a los de Claude Fable 5, pero a mitad de costo. Ahora forma parte por defecto del servicio Claude Max y es la opción más potente en Claude Pro.
El avance más significativo en la interfaz de desarrollo radica en el comportamiento predeterminado del "pensamiento". En la versión anterior, el sistema solo activaba la reflexión si el usuario configuraba explícitamente un parámetro. En Opus 5, esta función se activa automáticamente en todas las peticiones. El nivel de profundidad del razonamiento se regula mediante el parámetro "esfuerzo", que puede ir desde bajo hasta máximo. Dado que el límite de tokens incluye tanto el contenido pensado como la respuesta final, se recomienda revisar los valores existentes para evitar sobrecargas. Además, se introdujo una modificación que rompe con el comportamiento anterior: si se establece el pensamiento desactivado junto con un esfuerzo elevado o máximo, el sistema devuelve un error 400. Esta restricción se aplica por solicitud, obligando a los desarrolladores a reducir el esfuerzo a alto o eliminar el campo de pensamiento.
Anthropic también advierte que ciertos tipos de instrucciones, como "incluye una verificación final", generan respuestas excesivamente detalladas, ya que el modelo ya realiza autovigilancia de su propio contenido. Para evitar este comportamiento, se recomienda seguir las directrices de diseño de prompts publicadas en el nuevo guía de Opus 5. La identificación del modelo es "claude-opus-5". El contexto disponible se fija en un millón de tokens como valor predeterminado y máximo, sin opciones menores. La respuesta máxima en la API sincronizada es de 128 mil tokens, mientras que la API de lote de mensajes alcanza 300 mil tokens con la cabecera beta "output-300k-2026-03-24". El tamaño mínimo de prompt que puede ser almacenado en caché se redujo a 512 tokens, desde los 1.024 anteriores.
En pruebas de rendimiento, Opus 5 logró un 43,3% de precisión en una evaluación de 74 tareas, conocida como FrontierBench v0.1, superando ampliamente a su predecesor (18,7%) y a otros modelos como Fable 5 (33,7%) y GPT-5.6 Sol (37,5%). Al aplicar un esfuerzo máximo, el modelo alcanzó un promedio de recompensa del 44,4%, su desempeño más alto. Un detalle relevante es que los clasificadores de seguridad del modelo detectaron posibles riesgos en ciertos escenarios, aunque no se detallan.
Para los usuarios peruanos, esta evolución muestra cómo las herramientas de inteligencia artificial pueden mejorar la eficiencia en tareas complejas, como el análisis de datos o la automatización de procesos administrativos. Aunque el costo sigue siendo accesible, la necesidad de ajustar los prompts y entender el nuevo comportamiento del modelo es clave para evitar errores en aplicaciones reales. En un entorno donde la digitalización de servicios públicos y privados avanza, el acceso a tecnologías como Opus 5 podría permitir a pequeñas y medianas empresas optimizar sus operaciones sin necesidad de grandes inversiones.
