Meta informó el miércoles que uno de sus modelos de IA pirateó a otra empresa durante una prueba de ciberseguridad, después de que un error de su socio de pruebas le diera al modelo acceso no deseado a Internet.
Este incidente se suma a una creciente lista de casos en los que agentes de IA de importantes desarrolladores vulneraron sistemas de otras empresas durante las pruebas, después de que Anthropic anunciara la semana pasada que algunos de sus modelos piratearon tres empresas y de que OpenAI revelara que un agente de IA había vulnerado la seguridad de la startup Hugging Face.
Meta declaró que una configuración errónea por parte de la empresa de pruebas independiente Irregular permitió inadvertidamente que uno de sus modelos tuviera acceso a Internet durante una evaluación, y añadió que estaba investigando el incidente.
Según Meta, en un comunicado, el modelo «explotó una vulnerabilidad de seguridad en un servicio de terceros, de forma similar a casos previamente reportados con otras empresas».
Horas antes, The Information, citando fuentes, informó que el modelo Muse Spark 1.1 de Meta, que la compañía ha promocionado como su modelo más capaz para tareas de codificación y agentes del mundo real, vulneró la seguridad de una empresa no identificada y alteró sus sistemas internos.
Un portavoz de Irregular declaró a Reuters que el incidente fue «exactamente el mismo problema del entorno de evaluación que ya había revelado Anthropic la semana pasada» y que no implicó «una fuga del entorno de pruebas ni una acción cibernética sofisticada».
«Actualmente no hay problemas abiertos. Irregular está elaborando un documento técnico para compartir las mejores prácticas para la contención y la realización segura de evaluaciones cibernéticas», dijo Irregular.
Los incidentes revelados por Meta y Anthropic se debieron a errores que, sin querer, permitieron a sus modelos acceder a internet. Esto contrasta con OpenAI, cuyo agente de IA explotó de forma independiente una nueva vulnerabilidad para acceder a internet durante las pruebas cibernéticas.
Aun así, estas brechas ponen de manifiesto cómo la IA ha incrementado las amenazas a la ciberseguridad y cómo los desarrolladores pueden tener dificultades para mantener controladas las capacidades de sus modelos.
Es probable que estas revelaciones intensifiquen la iniciativa del gobierno estadounidense para gestionar mejor los riesgos de seguridad de la IA, en un momento en que Anthropic y OpenAI compiten por lanzar sistemas más avanzados antes de sus previstas salidas a bolsa. Destacados líderes de estos laboratorios han pedido que se ralentice el proceso para abordar primero los riesgos.
(Reporte de Rajveer Singh Pardesi y Abu Sultan en Bengaluru y Mrinmay Dey en Ciudad de México; Editado por Savio D’Souza y Subhranshu Sahu)
Fuente: reuters


