Anthropic pone una camisa de fuerza a su IA más peligrosa para proteger el código empresarial
Claude Mythos 5, antes restringido por los controles de exportación de EE. UU., ya escanea repositorios de GitHub, pero sigues sin poder hablar con él.

En junio, Claude Mythos 5 de Anthropic fue considerado tan capaz en operaciones de ciberofensiva que activó brevemente los controles de exportación de EE. UU. Quedó bajo llave, accesible únicamente para unos 150 ciberdefensores acreditados. Hoy, cualquier cliente de Claude Enterprise puede dirigir ese mismo modelo a su base de código y dejarlo actuar. Pero hay un truco brillante: no tienes permitido hablar con él.
La clase magistral de la "puerta lateral"
Anthropic ha logrado algo extraordinario al desacoplar la capacidad de una IA de su interfaz. Si abres una ventana de chat con un modelo totalmente desprotegido, un actor malicioso puede dirigirlo para que escriba exploits de día cero. Por eso, Anthropic eliminó la ventana de chat por completo. En lugar de un socio conversacional, Claude Security utiliza Mythos 5 como un motor invisible. Rastrea los flujos de datos a través de los archivos y devuelve únicamente artefactos defensivos: una categoría de debilidad, una puntuación de confianza y un parche sugerido. No le das instrucciones; simplemente dejas que lea y corrija.
“El comportamiento más riesgoso ocurre cuando un usuario tiene acceso directo a un modelo, donde un actor malicioso puede intentar dirigirlo hacia usos dañinos. Pero si los usuarios solo pueden recibir resultados específicos, como un parche para una vulnerabilidad o una alerta de seguridad, ese riesgo es mucho menor.”— Anthropic
Al meter al modelo en una estricta camisa de fuerza programática, Anthropic ha abierto la puerta para que las organizaciones utilicen herramientas de IA restringidas de forma segura. El modelo sigue siendo exactamente tan peligroso como lo era en junio, pero la interfaz hace que sea imposible convertirlo en un arma.
Reparar los cimientos de internet

Los escáneres de seguridad tradicionales son esencialmente libros gigantes de reglas. Buscan sintaxis incorrectas conocidas, lo que significa que pasan por alto fallos lógicos complejos y generan una cantidad exasperante de falsos positivos. Mythos 5 aporta algo completamente nuevo al análisis de código: la intención. Entiende cómo interactúan las distintas piezas de una aplicación y qué intentaba construir realmente el desarrollador.
Para acelerar este cambio, Anthropic no solo está vendiendo la herramienta a empresas con grandes presupuestos. Prácticamente están subsidiando la labor poco glamurosa de parchear internet. El modelo funciona a $10 por millón de tokens de entrada, descontándose de los planes Enterprise existentes, pero el nuevo fondo garantiza que las bibliotecas de código abierto reciban la misma defensa de élite antes de que los actores de amenazas puedan explotarlas.
La carga de saberlo todo
Desatar una IA hipercapaz en una base de código promedio ha revelado un problema profundamente irónico: Mythos 5 es demasiado bueno. Los primeros usuarios están descubriendo que el modelo no devuelve falsos positivos; devuelve cientos de vulnerabilidades reales y legítimas. Esto traslada por completo el cuello de botella de la seguridad. La pregunta ya no es si un hallazgo es real, sino si un microservicio vulnerable está realmente expuesto a internet y necesita corregirse hoy mismo. Además, desbloquear esta información requiere una concesión. Actualmente, Mythos 5 exige una política de retención de datos de 30 días, un obstáculo insalvable para los puristas del cumplimiento normativo que se niegan a permitir que terceros almacenen su código propietario.
El renacer de la guerra de la criptografía de los noventa
Ya hemos visto exactamente esta misma dinámica antes. En la década de 1990, el gobierno de EE. UU. clasificó la criptografía fuerte como armamento, restringiendo su exportación por temor a que los adversarios la usaran para ocultar sus comunicaciones. La industria tecnológica no ganó esa guerra entregando motores criptográficos puros a todo el mundo; la ganó integrando el cifrado en los protocolos de la web, garantizando que los usuarios obtuvieran el beneficio sin necesidad de un acceso directo. Anthropic está aplicando exactamente la misma estrategia para la inteligencia artificial. Al integrar Mythos 5 en lo más profundo del backend de las herramientas defensivas, se aseguran de que la ventaja estructural siga estando del lado de los defensores. El futuro de la seguridad de la IA no consiste en construir un modelo perfectamente seguro. Consiste en tomar los modelos más peligrosos del mundo y ponerlos a trabajar de nuestro lado.
Lo que dice la gente
“Many drugs work by binding to a specific target in the body and blocking or changing what it does. An important first step in the drug development process is designing a molecule that can bind tightly to its target. Traditionally, that's meant weeks or months of expert work per”
“ANTHROPIC SENDS SF STAFF HOME OVER SECURITY STRIKE CONCERNS Anthropic told employees to work from home Monday and Tuesday after receiving notice that security workers could potentially strike. However, the SEIU union representing those workers said no strike had been called or”
“We've been working on this with customers for a while. Mythos-class models require additional safety measures and enterprises need to meet their own privacy and compliance rules. Customers can own and control their own data and Anthropic retains none. It’s coming this fall.”
Anatomy of Claude Mythos 5
The Brief
Mantén la curiosidad
IA y tecnología: qué cambia y por qué importa.
Tu selección diaria, en inglés o español.
Gratis para siempre. Cancela cuando quieras.
Más historias

The Specialty News





Conversación
Inicia la conversación