Anthropic ha advertido que su futuro modelo Claude Mythos se convertirá en un «arma secreta de hackers»

Anthropic, OpenAI y otras empresas tecnológicas están desarrollando modelos de IA capaces de aumentar drásticamente la amenaza de ciberataques masivos a sistemas corporativos, gubernamentales y municipales. El foco está en el modelo de IA Claude Mythos de Anthropic, que aún no ha sido lanzado. Según Axios, la empresa ya está advirtiendo a altos funcionarios de EE.UU. que su aparición en 2026 aumenta significativamente la probabilidad de ataques de este tipo.

Anthropic ha advertido que su futuro modelo Claude Mythos se convertirá en un «arma secreta de hackers»

Mythos se describe como un sistema que permite a los agentes de IA infiltrarse de forma autónoma, con alta precisión y complejidad, en sistemas corporativos, gubernamentales y municipales. El director ejecutivo de Axios, Jim VandeHei, informó en su boletín para líderes que una de las fuentes familiarizadas con los futuros modelos de IA anticipa un ciberataque importante ya en 2026. Además, el sector empresarial ha sido identificado como un objetivo especialmente vulnerable.

Anteriormente, Fortune estudió los materiales filtrados del blog de Anthropic sobre Claude Mythos. En él, el modelo de IA se describe como un sistema que "actualmente supera significativamente cualquier otro modelo de IA en capacidades cibernéticas". También se menciona que Mythos "presagia una ola inminente de modelos de IA capaces de explotar vulnerabilidades de manera que superen con creces los esfuerzos de ciberseguridad". El riesgo se ve incrementado por empleados que utilizan agentes de IA sin comprender que esto podría facilitar el acceso de los cibercriminales a los sistemas internos de sus empresas.

A finales de 2025, Anthropic reveló registrará el primer caso documentado de un ciberataque, en gran medida llevado a cabo por IA. Un grupo apoyado por el estado chino utilizó agentes de IA para llevar a cabo hackeos autónomos en aproximadamente 30 objetivos en todo el mundo. La IA llevó a cabo entre el 80 % y el 90 % de las operaciones tácticas de manera autónoma. Esto ocurrió antes del aumento significativo de los sistemas de agentes y antes de que aparecieran nuevas y peligrosas formas de su aplicación.

Los nuevos modelos de IA se caracterizan por su mayor capacidad para mantener el funcionamiento autónomo de los agentes de IA. Se trata de sistemas que permiten a los agentes pensar, actuar, razonar e improvisar de manera independiente sin pausas ni fatiga. La magnitud del ataque ahora se determina principalmente por los recursos computacionales de los delincuentes, y no por el número de su agrupación. Ahora una sola persona puede la posibilidad realizar ciberataques que antes requerían equipos completos.

Al mismo tiempo, la vulnerabilidad de las empresas está aumentando. Los empleados utilizan cada vez más modelos de agentes como Claude, Copilot y otros, a menudo desde casa, y crean sus propios agentes de IA. En muchos casos, estos agentes, sin el debido control, acceden a sistemas internos de trabajo. Esto crea otra vía de entrada para los ciberdelincuentes. En la industria, este uso no autorizado o incontrolado de la IA se llama «IA sombría».

Una encuesta de Dark Reading mostró que el 48 % de los especialistas en ciberseguridad consideran que la IA de agente es el principal vector de ataques en 2026. Esta amenaza está considerada más grave que los deepfakes y que otros riesgos incluidos en la encuesta. Cada empleado de cualquier empresa en el mundo necesita comprender ahora el riesgo de utilizar agentes de IA cerca de información sensible. El equipo técnico de Axios considera que esta amenaza es la mayor para las empresas en este momento. La conclusión práctica es una: se necesita un entorno seguro y aislado para trabajar con agentes de IA.

Fuente:


Fuente: 3dnews.ru
Compra un hosting fiable para sitios web con protección contra DDoS, servidores VPS VDS 🔥 Compra un hosting fiable para sitios web con protección contra DDoS, servidores VPS VDS | ProHoster