Tres modelos de IA de Anthropic lograron acceder a internet y entrar en sistemas reales

por Dennys Bracho

La empresa estadounidense Anthropic, desarrolladora del asistente de inteligencia artificial Claude, informó que tres de sus modelos lograron acceder a internet e ingresar a sistemas reales de tres organizaciones durante pruebas de ciberseguridad.

La compañía explicó que los incidentes ocurrieron debido a una configuración incorrecta en los entornos de evaluación, lo que permitió que los modelos tuvieran acceso a la red pese a que las pruebas estaban diseñadas para realizarse en escenarios simulados.

Anthropic indicó que detectó los casos durante una revisión de seguridad iniciada luego de que OpenAI reportara incidentes similares con algunos de sus modelos de inteligencia artificial.

Claude superó los límites previstos en pruebas

Según la empresa, se analizaron más de 146.000 operaciones en las que Claude pudo haber tenido acceso a internet. Durante esa revisión fueron identificados tres casos en los que un modelo logró conectarse a la red y posteriormente acceder a sistemas pertenecientes a organizaciones externas.

Los incidentes comenzaron en abril e involucraron a tres modelos diferentes: Claude Opus 4.7, Claude Mythos 5 y un modelo interno de prueba.

Anthropic señaló que los modelos habían recibido instrucciones para intentar infiltrarse en sistemas ficticios dentro de un entorno controlado, dejando claro que se trataba de una simulación y que no tenían conexión a internet.

Sin embargo, un error de coordinación con el socio encargado de las evaluaciones permitió que los modelos tuvieran acceso real a la red, por lo que completaron acciones fuera del entorno previsto.

Crecen las alertas sobre seguridad de la inteligencia artificial

El caso vuelve a abrir el debate sobre los riesgos asociados al desarrollo de modelos de inteligencia artificial con mayores capacidades autónomas, especialmente cuando pueden interactuar con herramientas externas, redes y sistemas informáticos.

Anthropic aseguró que trabaja en mejorar sus controles de seguridad para evitar que situaciones similares puedan repetirse durante futuras evaluaciones.

Con información de SWI

Manténgase conectado e informado en cada una de nuestras plataformas:

Instagram: notiprimicia

WhatsApp: NotiPrimicia

Telegram: NotiPrimicia

YouTube: @NotiPrimicia

 TikTok: @notiprimicia

Lea también