Cómo llegamos aquí
El 9 de junio, Anthropic lanzó Claude Fable 5, una versión con salvaguardas de Mythos. Días después, la empresa admitió haber ocultado restricciones para evitar que investigadores entrenaran sistemas rivales. El 12 de junio, la orden de control de exportaciones dejó sin acceso a todos los usuarios no estadounidenses, incluidos empleados de Anthropic.
Pero los hechos que detonaron la decisión comenzaron antes:
- En marzo, el investigador de Anthropic Nicholas Carlini –un hacker respetado– demostró que Mythos podía encontrar vulnerabilidades en Linux y en el software Ghost, algo que él mismo nunca había logrado. Dos días después advirtió internamente: "No creo que debamos lanzar Mythos todavía".
- SK Telecom recibió acceso temprano a Mythos como parte del grupo Project Glasswing. Funcionarios de EE.UU. alegaron vínculos de la empresa con China, aunque SK Telecom lo negó.
- Amazon luego informó a la Casa Blanca que podía sortear las salvaguardas de Fable 5, algo que Anthropic y expertos externos consideran un riesgo común a cualquier modelo de IA.
Lo que no se dice
Aunque Anthropic y el gobierno siguen en desacuerdo, el debate de fondo es la inevitabilidad de que otros modelos –de código abierto o de competidores– alcancen capacidades similares a Mythos. Expertos señalan que bloquear a Anthropic solo retrasa un problema que no desaparecerá.
Lo que dicen
- Nicholas Carlini: "Estos modelos son mejores investigadores de vulnerabilidades que yo". Considera que el equilibrio entre atacantes y defensores está llegando a su fin.
- Anthropic: Se negó a comentar sobre las acusaciones de vínculos de SK Telecom con China. En su blog, reconocen que el uso avanzado de IA es de doble filo.
- SK Telecom: No respondió a solicitudes de comentario para este artículo, pero ante reportes previos dijo a un diario coreano que la información anónima era falsa.
Lo que cambia
Anthropic desactivó ambos modelos globalmente en lugar de filtrar por nacionalidad, un proceso que consideró inviable respetando la privacidad. Las negociaciones con la Casa Blanca continúan, pero hasta ahora no hay acuerdo para restaurar el acceso.
Mientras tanto, la comunidad de ciberseguridad sigue procesando lo que llaman "Bugmageddon": la certeza de que la IA ya supera a los humanos en encontrar y explotar fallos. La decisión de Trump pudo haber frenado a Anthropic, pero el problema –y los modelos– no desaparecieron.