Anthropic confirma 'Mythos', su modelo más potente, tras una filtración accidental
El modelo de nueva generación de Anthropic, conocido internamente como Mythos o Capybara, quedó expuesto por un error de configuración en el gestor de contenidos. La empresa confirmó que representa un 'cambio de nivel' en capacidades, con implicaciones inéditas para la ciberseguridad.
Anthropic no tenía previsto anunciar su próximo modelo insignia esta semana. Un error humano en el sistema de gestión de contenidos de la empresa lo decidió por ella.
Los investigadores de seguridad Roy Paz, de LayerX Security, y Alexandre Pauwels, de la Universidad de Cambridge, descubrieron un almacén de datos público y no protegido que contenía un borrador de entrada de blog con detalles precisos del modelo. El modelo tiene dos nombres internos: Capybara (el nombre de desarrollo) y Mythos (el nombre de marketing, aparentemente el sucesor de la línea Opus).
Un portavoz de Anthropic confirmó que la exposición fue real y no intencionada, describiendo Mythos como “el modelo más capaz que hemos construido” y calificando su rendimiento como un “cambio de nivel” respecto a Claude Opus 4.6. Clientes de acceso anticipado ya lo están probando.
Lo que reveló el borrador filtrado
En benchmarks de programación, Mythos supera a Opus 4.6 con una diferencia considerable. El mismo patrón se repite en razonamiento académico y, de forma especialmente llamativa, en evaluaciones de ciberseguridad. El borrador describía la capacidad del modelo para identificar y explotar vulnerabilidades de software a una velocidad que investigadores de seguridad califican de “sin precedentes” para un sistema disponible comercialmente.
Esta última capacidad es la que genera mayor alarma. Documentos internos de Anthropic incluidos en el caché expuesto advierten que Mythos podría acelerar significativamente una carrera armamentista cibernética: la explotación autónoma de vulnerabilidades de día cero a velocidad de máquina, accesible vía API, plantea un modelo de amenaza distinto a todo lo que el sector de la seguridad ha afrontado hasta ahora.
El modelo se está probando bajo lo que Anthropic describe como “salvaguardas reforzadas”, aunque la empresa no ha revelado en qué consisten en la práctica.
Un momento cargado de tensión
Anthropic está inmersa en un litigio con el Departamento de Defensa estadounidense sobre los usos permitidos de sus modelos en aplicaciones militares y de vigilancia. La filtración llega mientras ese caso sigue abierto y mientras la empresa intenta posicionarse como el laboratorio de IA que antepone la seguridad.
Lanzar un modelo que sus propios documentos internos señalan como riesgo de ciberseguridad, aunque sea con salvaguardas, pondrá a prueba ese posicionamiento. Anthropic no ha anunciado fecha de lanzamiento público para Mythos.
Claude Opus 4.6 ya era uno de los modelos con mejor rendimiento en tareas agénticas y de razonamiento. Si Mythos representa un salto real de capacidades y no una mejora incremental, la distancia respecto al resto de modelos disponibles comercialmente será significativa.
El borrador del blog ya está escrito. Cabe esperar que Anthropic acelere el anuncio formal.
Lecturas relacionadas
- Modelos de IA Anthropic reconoce que sus propios modelos Claude entraron sin permiso en tres empresas durante pruebas de seguridad
- Modelos de IA Los propios modelos de OpenAI hackearon Hugging Face para hacer trampa en un test de seguridad
- Modelos de IA Anthropic presenta su S-1 confidencial: 47.000 millones de ingresos y valoración de 965.000 millones