Volver al Blog
Modelos de IA 28 de marzo de 2026 5 min read

Anthropic filtra accidentalmente 'Claude Mythos': su modelo más potente y peligroso hasta la fecha

Un fallo en el gestor de contenidos expuso cerca de 3.000 activos inéditos de Anthropic el 27 de marzo, incluidos documentos internos sobre Claude Mythos: un modelo que la propia empresa describe como de riesgo cibernético sin precedentes.

Anthropic filtra accidentalmente 'Claude Mythos': su modelo más potente y peligroso hasta la fecha

El sistema de gestión de contenidos de Anthropic expuso el 27 de marzo de 2026 aproximadamente 3.000 activos sin publicar —documentos internos, imágenes y PDFs— que revelaron la existencia de un modelo inédito llamado Claude Mythos. La compañía confirmó la filtración el mismo día en lugar de negarla, y esa decisión lo dice todo: esto es real, y su lanzamiento está próximo.

Qué dicen los documentos

En los materiales filtrados, Mythos se describe como “el sistema más potente que la empresa ha construido hasta la fecha”. Tres áreas de capacidad destacan sobre las demás:

  • Programación de software — mejora sustancial respecto a Claude Opus 4.6
  • Razonamiento académico — resultados de primer nivel en matemáticas y ciencias
  • Ciberseguridad — los propios documentos de Anthropic afirman que el modelo “supera con creces a todos los modelos de IA existentes” en este ámbito

Este último punto explica la estrategia de despliegue restringido. Anthropic afirma que Mythos presenta “riesgos de ciberseguridad sin precedentes”, una fórmula que la empresa no había utilizado con ningún modelo anterior. El plan contempla un lanzamiento solo para invitados, limitado inicialmente a clientes seleccionados que lo utilicen específicamente para defensa en ciberseguridad. No hay lanzamiento público previsto a corto plazo.

La filtración en sí

La exposición se produjo por una mala configuración del CMS, no por una brecha externa. Cerca de 3.000 activos en fase de preparación quedaron accesibles públicamente: un fallo operativo embarazoso para una empresa cuya propuesta de valor entera se basa en el desarrollo responsable y controlado de la IA. Los activos filtrados incluían borradores de entradas de blog, PDFs internos e imágenes asociadas al posicionamiento del producto Mythos.

La decisión de Anthropic de confirmar en lugar de minimizar la filtración fue estratégicamente acertada. Negar la existencia de un modelo que miles de personas pueden haber almacenado en caché es una posición perdedora. La confirmación también permite a Anthropic controlar la narrativa: se trata de un despliegue restringido con la seguridad como prioridad, no de una publicación incontrolada.

El retiro en el Reino Unido

Entre los activos filtrados: los planes de un retiro privado solo para invitados en el Reino Unido donde el CEO Dario Amodei demostrará personalmente las funcionalidades de Mythos a ejecutivos corporativos europeos. Esto encaja con el patrón empresarial de Anthropic: acceso ejecutivo directo para clientes de alto valor antes del despliegue más amplio.

Por qué importa el ángulo de la ciberseguridad

“Supera con creces a todos los modelos de IA existentes” en benchmarks de ciberseguridad es una afirmación extraordinaria. Si es precisa, Mythos representa un punto de inflexión en la investigación automatizada de vulnerabilidades, la generación de exploits y el análisis de amenazas. Precisamente por eso Anthropic lo mantiene inicialmente en un programa cerrado: demostrar que funciona para la defensa mientras se limita la exposición ofensiva.

El contexto de los modelos anteriores ayuda a calibrar el alcance. Claude Opus 4.6 ya ocupa el primer puesto en SWE-Bench con un 80,8%. Un “salto cualitativo” por encima de ese nivel, aplicado a la ciberseguridad, sugiere que Mythos puede detectar y razonar sobre vulnerabilidades a un nivel que los modelos actuales no alcanzan.


Fuentes: Fortune — fortune.com/2026/03/27/anthropic-leaked-ai-mythos-cybersecurity-risk; The News — thenews.com.pk/latest/1396861, 27 de marzo de 2026

anthropic claude mythos security ai-models