Claude Opus 5 supera las 129 pruebas de inyección de indicaciones (prompt injection) en agentes de navegador sin ceder

Según la divulgación de Anthropic a través de la plataforma de noticias de IA Beating, Claude Opus 5 superó sin comprometerse los 129 escenarios de pruebas de inyección de prompts para agentes de navegador, lo que supone un avance significativo en la seguridad de los agentes de IA. En las pruebas del benchmark universal de inyección de prompts de Gray Swan, Opus 5 logró una tasa de éxito del ataque del 2,0% tras 15 intentos, superando de forma sustancial a su predecesor Opus 4, que obtuvo un 5,5%, así como a los modelos competidores Mythos 5 con un 2,6% y Fable 5 con un 2,8%.
Aviso legal: La información en esta página puede provenir de fuentes de terceros y es solo para referencia. No representa las opiniones ni puntos de vista de Gate y no constituye asesoramiento financiero, de inversión ni legal. El comercio de activos virtuales implica un alto riesgo. No te bases únicamente en la información presentada en esta página para tomar decisiones. Para más detalles, consulta el Aviso legal.
Comentar
0/400
Sin comentarios