Claude Mythos ayuda a exponer una vulnerabilidad crítica del chip M5 de Apple, lo que genera inquietudes sobre la seguridad de la IA.

Actualización definitiva: 05/17/2026
  • Investigadores californianos utilizaron la versión preliminar Claude Mythos de Anthropic para crear un exploit funcional contra el sistema de seguridad M5 Memory Integrity Enforcement de Apple en menos de una semana.
  • El ataque combina dos fallos de seguridad y técnicas avanzadas para provocar la corrupción de la memoria del kernel de macOS y obtener acceso a áreas restringidas del sistema.
  • Los expertos describen esto como la primera vulnerabilidad pública que logra eludir las nuevas protecciones MIE asistidas por hardware de Apple en los chips M5.
  • Este caso aviva el debate sobre el acceso controlado a potentes modelos de IA que pueden tanto reforzar como socavar la ciberseguridad.

Vulnerabilidad de IA en el chip M5 de Apple

En los últimos días, un experimento de ciberseguridad de bajo perfil se ha convertido en un tema de conversación importante en toda la comunidad de seguridad: una versión preliminar del modelo avanzado de IA de Anthropic, Claude MythosSe le atribuye haber ayudado a superar una de las defensas de hardware más recientes de Apple en sus chips M5. Este episodio se considera un ejemplo concreto de cómo la IA de vanguardia puede descubrir fallos críticos y, potencialmente, redefinir el equilibrio entre atacantes y defensores.

Según investigadores de la startup Calif, con sede en Palo Alto, Modelo de vista previa de Mythos Desempeñó un papel crucial en la creación de una vulnerabilidad que compromete la última protección de integridad de memoria (MIE) de Apple en las Mac con procesador M5. Si bien el ataque aún requirió una gran experiencia humana, el equipo afirma que la IA aceleró drásticamente el descubrimiento de fallos explotables, lo que plantea nuevas preguntas sobre quién debería tener acceso a dichos sistemas y bajo qué condiciones.

Cómo Claude Mythos ayudó a vulnerar las protecciones M5 de Apple.

El núcleo de la historia se centra en Calif, una empresa de ciberseguridad con sede en el centro tecnológico de California, Palo Alto, que se propuso evaluar qué tan bien funciona Apple. Nuevo mecanismo MIE en chips M5 Podría resistir las técnicas de explotación modernas. En el transcurso de esa investigación, el equipo utilizó Claude Mythos Preview de Anthropic como una especie de copiloto de IA para analizar las rutas del código, razonar sobre posibles vulnerabilidades y priorizar las superficies de ataque prometedoras.

Los investigadores de California informan que finalmente lograron combinar Dos fallos de software distintos con varias técnicas de pirateo especializadas. El objetivo era lograr una corrupción de memoria a nivel de kernel en macOS, que se ejecutaba en hardware M5. Esta corrupción les permitió acceder a partes del sistema que normalmente están restringidas, eludiendo así algunas de las protecciones de hardware más avanzadas de Apple.

Lo que hace que este caso destaque es que la explotación resultante parece ser, en palabras citadas por múltiples informes, la Primer ataque de corrupción de memoria del kernel de macOS conocido públicamente que sobrevive a las protecciones MIE de Apple en los chips M5. Para un mecanismo de defensa que Apple ha estado promocionando como un gran avance tras años de inversión, ver que una vulnerabilidad pública se materializa tan rápidamente ha llamado la atención de la industria.

Diversas fuentes, entre ellas The Wall Street Journal y medios especializados en Mac, han destacado que la vulnerabilidad no se basa en fallos de hardware inusuales ni en trucos de acceso físico. En cambio, encadena fallos lógicos que, una vez identificados, pueden convertirse en una ruta de ataque consistente capaz de neutralizar las medidas de seguridad de MIE en los sistemas afectados.

El propio estado de California describió el proyecto como una prueba de lo que sucede cuando... Las herramientas de IA de alta gama se combinan con desarrolladores de exploits experimentados.En lugar de un escenario de pirateo automatizado con un solo clic, la velocidad y la sofisticación del resultado han generado preocupación sobre la rapidez con la que estas capacidades podrían propagarse si no se controlan estrictamente.

¿Qué es la aplicación de la integridad de la memoria en el chip M5?

Apple presentó Aplicación de la integridad de la memoria Como característica de seguridad insignia de su línea de chips M5, diseñada para proteger los dispositivos contra categorías enteras de ataques de corrupción de memoria, la idea es sencilla pero ambiciosa: utilizar soporte de hardware dedicado para monitorear y limitar el uso de la memoria, dificultando enormemente que los atacantes secuestren la ejecución de código de bajo nivel.

Según el análisis de Calif, Apple pasó aproximadamente cinco años llevando MIE desde el concepto hasta el producto comercializado, con una inversión que probablemente alcanzó los miles de millones de dólares. La compañía posicionó MIE como un cambio radical para seguridad de memoria asistida por hardwarecon el objetivo de erradicar las técnicas de explotación de larga data que se habían utilizado contra las generaciones anteriores de dispositivos iOS y macOS.

Antes de la investigación de Calif, MIE había tenido, según se informa, mucho éxito en la práctica. La empresa emergente afirma que todas las cadenas de exploits conocidas públicamente MIE había dificultado los ataques dirigidos a los sistemas iOS actuales, incluidos los paquetes de alto perfil como Coruna y Darksword, filtrados recientemente. En otras palabras, MIE se consideraba un obstáculo importante para los atacantes que recurrían a patrones clásicos de corrupción de memoria.

En este contexto, la aparición de una vulnerabilidad pública de corrupción de memoria del kernel que puede operar a pesar de las protecciones de MIE en el hardware M5 se considera un desarrollo técnico y simbólico significativo. Esto no significa que MIE haya fallado por completo, pero sí demuestra que Los investigadores decididos aún pueden encontrar vías de ataque viables., especialmente cuando se cuenta con el apoyo de potentes herramientas analíticas como Claude Mythos.

Los detalles técnicos se mantienen en secreto; Calif y Anthropic aún no han publicado la documentación completa de la cadena de exploits, enfatizando que están esperando hasta que Apple haya abordado completamente el problema. Sin embargo, sus comentarios sugieren que, si bien MIE eleva el listón sustancialmente, no es un escudo inquebrantable, y las futuras mitigaciones deberán asumir que Descubrimiento de vulnerabilidades acelerado por IA forma parte del panorama de amenazas.

Cronología: desde el descubrimiento del error hasta la explotación funcional en menos de una semana.

Uno de los aspectos más llamativos del relato de Calif es la velocidad de desarrollo. La empresa ha presentado una cronología bastante precisa que muestra que todo el exploit —desde la identificación inicial del error hasta una prueba de concepto funcional y fiable— se desarrolló en menos de siete días, una velocidad que incluso los profesionales de la seguridad más experimentados consideran notable.

Tal como lo describió el equipo, el proceso comenzó cuando el investigador Bruce Dang detectaron los primeros errores relevantes el 25 de abril. En un par de días, el especialista en seguridad Dion Blazakis Se unió al esfuerzo el 27 de abril, aportando conocimientos especializados adicionales para dar forma a la estrategia de ataque en evolución y comprender mejor cómo respondió MIE a los primeros intentos de explotación.

Poco después, el ingeniero Josh Maine se centró en construir las herramientas necesarias. para explorar, probar y perfeccionar las rutas de explotación sugeridas tanto por los investigadores humanos como por el modelo Mythos. Para el 1 de mayo, pocos días después del descubrimiento inicial, Calif afirma haber logrado una vulnerabilidad del kernel completamente funcional capaz de eludir MIE en sistemas M5 específicos.

Los investigadores destacan que este rápido cambio no fue simplemente el resultado de la automatización. En cambio, describen un flujo de trabajo de ida y vuelta en el que Mythos Preview reveló patrones de vulnerabilidad prometedores.que expertos humanos validaron, refinaron y encadenaron en una estrategia coherente. El estrecho ciclo entre las hipótesis generadas por la IA y el análisis de los expertos parece haber comprimido en cuestión de días un proceso que de otro modo habría tardado semanas o meses.

Calif describió el logro como una demostración temprana pero reveladora de "lo que sucede cuando la inteligencia artificial y la experiencia humana convergen" en el ámbito de la seguridad ofensiva. Lograr una vulnerabilidad en el kernel contra lo que consideran las protecciones más robustas de Apple "en una semana" es, en sus palabras, una señal de que esta combinación probablemente se convierta en una fuerza poderosa, una que los defensores deberán tener en cuenta en el futuro.

El papel de Claude Mythos: poderoso, pero no totalmente autónomo.

Un elemento central de esta historia es Anthropic's Avance de Claude MythosSe trata de un modelo que no se ha hecho público precisamente por sus avanzadas capacidades de análisis y explotación de vulnerabilidades de software. En cambio, el acceso está restringido a un grupo selecto de grandes empresas tecnológicas, instituciones financieras y organizaciones de investigación acreditadas, en el marco del Proyecto Glasswing de Anthropic.

Calif enfatizó repetidamente que el sistema de IA contribuyó significativamente a cada etapa del desarrollo del exploit. Según la startup, Mythos demostró la capacidad de reconocer rápidamente cuándo los errores recién descubiertos encajaban en clases de exploits bien comprendidasy sugerir formas en que esas debilidades podrían combinarse o manipularse. Esta capacidad de reconocimiento de patrones permitió al equipo evitar grandes extensiones de ensayo y error manual.

La empresa describió Mythos con un lenguaje que resalta tanto su poder como su generalidad: una vez que el modelo ha aprendido a atacar un objetivo particular categoría de problemas de seguridadPuede generalizar ese conocimiento a una amplia variedad de objetivos similares. Esto significa que las mismas técnicas conceptuales que funcionan en un programa informático podrían transferirse, con algunos ajustes, a sistemas completamente diferentes.

Aun así, los investigadores de California se cuidan de subrayar que El juicio humano siguió siendo fundamental.MIE en los chips M5 es una capa de mitigación relativamente nueva, y algunos aspectos de su comportamiento bajo ataque activo aún no se habían comprendido del todo, ni siquiera internamente en Apple. Por lo tanto, para entender cómo eludir o sortear estas protecciones, se requería que desarrolladores de exploits experimentados interpretaran las sugerencias de la IA, las probaran con hardware real y las perfeccionaran basándose en la información sutil obtenida de los fallos, los registros y el comportamiento del sistema.

El equipo se ha esforzado por refutar la idea de que Mythos es un "generador de exploits con solo pulsar un botón". En cambio, lo presentan como un asistente extremadamente capaz que amplifica las habilidades humanas, especialmente al acortar el tiempo necesario para pasar de Desde el descubrimiento de errores hasta su explotación prácticaSin embargo, el hecho de que exista una herramienta de este tipo, y que pueda ser tan eficaz en manos expertas, está alimentando un amplio debate sobre los controles de acceso y su implementación responsable.

Reacción de la industria y respuesta de Apple

El descubrimiento ha generado un gran interés en todo el mundo tecnológico, tanto por la sofisticación técnica de la vulnerabilidad como por la forma en que fue construida. Medios de comunicación como El Wall Street Journal Han presentado el caso como un cambio notable en las capacidades de ciberseguridad ofensiva, donde la IA pasa de ser una preocupación teórica a un facilitador concreto de ataques de alta gama.

Por parte de Apple, los comentarios públicos han sido cautelosos. En una declaración citada por el WSJ, un representante de Apple se apoyó en la línea estándar de la compañía que La seguridad del usuario es una prioridad absoluta. Asimismo, la empresa asegura que cualquier vulnerabilidad reportada se investiga exhaustivamente. Más allá de esto, no ha proporcionado información detallada sobre la vulnerabilidad específica de Calif ni sobre cómo podría afectar a futuras versiones de MIE.

Sin embargo, hay indicios de que Apple ya ha comenzado a tomarse en serio los hallazgos. Los observadores han notado referencias a ambos Calif y Anthropic Research en las notas de la publicación Para macOS Tahoe 26.5, una actualización publicada un lunes reciente. Esto se ha interpretado como una señal de que al menos se están tomando medidas para mitigar la vulnerabilidad, aunque ni California ni Apple han confirmado con exactitud qué aspectos de la misma, si es que alguno, se han corregido por completo.

Por su parte, California ha recalcado que está reteniendo la documentación técnica completa hasta que Apple haya “eliminado definitivamente el vector de ataque”. La empresa optó por revelar la vulnerabilidad en persona En la sede de Apple en California, en lugar de recurrir a los canales estándar de envío de errores, alegando el deseo de evitar perderse en la avalancha de informes que reciben los grandes proveedores, especialmente en torno a eventos como Pwn2Own, donde la divulgación coordinada puede volverse caótica fácilmente.

Este enfoque de divulgación relativamente directo y cara a cara sugiere que todas las partes reconocen la delicadeza de una vulnerabilidad que no solo afecta a la arquitectura de chips más reciente de Apple, sino que también pone de manifiesto el creciente papel de la IA en el descubrimiento de este tipo de fallos. Hasta que se conozcan más detalles, gran parte de la comunidad se ve obligada a interpretar la información implícita en breves declaraciones públicas y escasas pistas técnicas.

¿Por qué Anthropic restringió el acceso a Claude Mythos?

La decisión de Anthropic de mantener Claude Mythos fuera del alcance del público en general Este incidente es anterior al episodio entre California y Apple, pero se interpreta como una confirmación de esa cautela. Durante las pruebas internas y las evaluaciones externas, la empresa observó que Mythos podía identificar de forma autónoma y, en algunos casos, ayudar a explotar vulnerabilidades de software a un nivel superior al de cualquier sistema de IA público anterior.

A la luz de esos hallazgos, Anthropic optó por un lanzamiento estrictamente controlado. Bajo la iniciativa a veces denominada Proyecto GlasswingMythos solo está disponible para socios selectos —grandes empresas tecnológicas, bancos y una lista reducida de organizaciones de investigación— que se comprometen a operar bajo estrictas directrices de uso. El objetivo es aprovechar las ventajas del modelo para la seguridad defensiva y la investigación, al tiempo que se reduce el riesgo de que atacantes oportunistas puedan usarlo indebidamente.

Esta estrategia no ha apaciguado por completo las preocupaciones. Algunos observadores de la industria argumentan que incluso el acceso limitado a dicha herramienta podría acelerar una dinámica de "carrera armamentística", donde las organizaciones con acceso privilegiado pueden desarrollar rápidamente tecnología de vanguardia. capacidades ofensivaslo que podría desestabilizar el ecosistema en general. Otros argumentan que es mejor que los defensores capacitados exploren y comprendan estas técnicas ahora, en lugar de esperar a que actores menos escrupulosos las alcancen.

Para complicar aún más el debate, se ha informado de que Mythos ya ha ofrecido resultados impresionantes en contextos puramente defensivos. Se dice, por ejemplo, que Mozilla ha observado que el modelo identifica cientos de vulnerabilidades potenciales en Firefox Durante las pruebas internas, se detectaron 271 problemas en un caso concreto. Hallazgos como estos sugieren que las mismas características que hacen de Mythos una herramienta eficaz para el desarrollo de exploits también la convierten en un aliado excepcionalmente poderoso para el endurecimiento del software.

Anthropic no se ha comprometido públicamente con ningún plazo para un mayor acceso a Mythos, y sucesos como la vulnerabilidad M5 probablemente refuercen los argumentos para mantener o incluso endurecer las restricciones actuales. Por ahora, el modelo sigue siendo una especie de instrumento especializado, utilizado en un número limitado de entornos de seguridad de alto riesgo donde se reconoce explícitamente su doble uso.

La IA en la ciberseguridad: un arma de doble filo cada vez más frecuente.

El caso de explotación en California se ha convertido rápidamente en un punto de referencia en la conversación más amplia sobre El papel de la IA en la ciberseguridadPor un lado, la capacidad de herramientas como Mythos para analizar código rápidamente, detectar patrones de errores sutiles y sugerir estrategias de ataque o defensa podría mejorar drásticamente la rapidez con la que los defensores encuentran y corrigen vulnerabilidades. Por otro lado, estas mismas capacidades pueden acortar el ciclo de desarrollo de exploits sofisticados, especialmente cuando son utilizadas por equipos altamente capacitados.

Los profesionales de la seguridad llevan mucho tiempo preocupados por un futuro en el que los sistemas de IA podrían hacerse cargo de gran parte del flujo de trabajo ofensivo, desde el reconocimiento hasta el desarrollo de exploits y el movimiento lateral. El episodio del M5 aún no representa la automatización completa, pero ofrece una visión de cómo será cuando La IA se convierte en un componente integral y de gran influencia. de una cadena de ataque del mundo real, incluso en manos de investigadores responsables.

Muchos expertos en el sector prevén que la explotación asistida por IA se convertirá cada vez más en la norma en el extremo superior del espectro de amenazas. Es probable que los atacantes con recursos suficientes, ya sean grupos criminales o actores respaldados por estados, exploren o desarrollen sus propios modelos similares a Mythos, utilizándolos para analizar enormes bases de código y descubrir puntos débiles que serían imposibles de encontrar para un ser humano.

Al mismo tiempo, los defensores ven este incidente como una llamada de atención. Si la ofensiva puede acelerarse hasta este grado, entonces... canalizaciones de parcheo, prácticas de revisión de código y procesos de gestión de vulnerabilidades Puede que sea necesario replantearlo para mantenerse al día. Algunas organizaciones ya están experimentando con herramientas de auditoría asistidas por IA, con la esperanza de utilizar técnicas similares para prevenir ataques mediante la detección y corrección temprana de vulnerabilidades.

La historia de California y Apple se sitúa, por tanto, en medio de un panorama en constante evolución, donde la IA ya no es una preocupación abstracta del futuro, sino un actor clave en el ámbito de la seguridad. La forma en que las empresas decidan implementar, restringir o regular estos modelos en los próximos años probablemente determinará no solo incidentes puntuales, sino también la trayectoria general del riesgo digital.

En conjunto, la vulnerabilidad contra el sistema de cumplimiento de integridad de memoria M5 de Apple, el papel central desempeñado por Avance de Claude MythosTanto la forma controlada como la controvertida en que Anthropic gestiona el acceso al modelo apuntan en la misma dirección: la IA avanzada se está integrando cada vez más con la mecánica de la ciberseguridad moderna. Este caso en particular demuestra que, cuando los modelos de lenguaje de última generación colaboran con investigadores humanos experimentados, pueden descubrir y poner en práctica graves fallos de hardware en plazos sorprendentemente cortos; una realidad emergente que tanto los proveedores como los defensores deberán tener en cuenta al diseñar la próxima generación de protecciones.

Interruptor de muerte
Artículo relacionado:
Nvidia rechaza las acusaciones de "interruptor de seguridad" y las propuestas de políticas para chips de IA
Artículos Relacionados: