IA y modelos
Expertos en ciberseguridad protestan contra la prohibición de EE. UU. a los modelos de Anthropic
Expertos en ciberseguridad protestan contra la prohibición de exportación del gobierno de EE. UU. a los modelos Fable y Mythos de Anthropic, argumentando que la restricción podría basarse en suposiciones de seguridad erróneas.
Un grupo de 76 expertos en ciberseguridad ha publicado una carta abierta pidiendo al gobierno de EE. UU. que levante su orden de control de exportaciones sobre los modelos Fable y Mythos de Anthropic. Los firmantes, entre los que se encuentra la experta en ciberseguridad Katie Moussouris, argumentan que la acción del gobierno ha privado a los defensores de la ciberseguridad de los mejores modelos. Afirman que retirar estas capacidades a los defensores sin una buena razón, mientras los adversarios avanzan rápidamente, es “peligroso”. La carta abierta sostiene que la prohibición obstaculiza la capacidad de los profesionales de la seguridad para encontrar vulnerabilidades y proteger el software.
El gobierno de EE. UU. emitió la orden de control de exportaciones el viernes, instruyendo a Anthropic a limitar la exportación de Fable y Mythos debido a preocupaciones de seguridad nacional. En respuesta, Anthropic suspendió el acceso a los modelos para todos los usuarios a nivel mundial, afectando a organizaciones en 15 países. La restricción interrumpió un despliegue planificado de Mythos, que se lanzó como vista previa en abril. Anthropic había dado acceso inicialmente a alrededor de 50 empresas, ampliando posteriormente ese grupo a alrededor de 150 organizaciones antes de que se impusiera la prohibición de exportación. La semana pasada, Anthropic lanzó Fable, una versión del modelo equipada con estrictas guardrails (restricciones de seguridad integradas en los modelos de IA), diseñadas para bloquear su uso en ciberseguridad.
Anthropic declaró que la orden de control de exportaciones podría haberse basado en un informe sobre un método para eludir las guardrails de Fable. Sin embargo, los expertos en ciberseguridad argumentan que la investigación subyacente, realizada por investigadores de Amazon, no demuestra un jailbreak real, que es una técnica para eludir las guardrails de seguridad de la IA. En cambio, el método descrito en el documento de Amazon simplemente consistía en pedir al modelo que corrigiera código con vulnerabilidades conocidas o plantadas deliberadamente. Según el grupo de expertos, este método puede replicarse en otros modelos de IA, incluidos GPT-5.5 de OpenAI, Claude Opus 4.8 y Sonnet de Anthropic, y Kimi 2.7.
Moussouris, una de las firmantes de la carta, señaló que el comportamiento descrito en el documento de Amazon no puede corregirse de manera significativa, y que intentar hacerlo solo debilitaría el modelo para fines defensivos. Explicó: “Los defensores necesitan poder pedirle a la IA que corrija los errores en un archivo, explique por qué la corrección es importante y escriba pruebas que confirmen que el parche funciona. Eso no es eludir una guardrail. Es lo más valioso que un modelo de IA puede hacer por la seguridad defensiva: ejecutar el ciclo de encontrar, corregir y probar que los defensores realizan todos los días”. La carta también pidió regulaciones transparentes creadas a través de un proceso democrático de elaboración de normas, diseñado para garantizar la seguridad del público estadounidense.
Por qué importa
La orden de control de exportaciones del gobierno de EE. UU. sobre los modelos Fable y Mythos de Anthropic ha eliminado herramientas críticas para los defensores de la ciberseguridad, provocando una protesta de expertos de la industria que argumentan que la prohibición obstaculiza su capacidad para proteger el software.