La compañía explicó que el incidente ocurrió debido a una configuración incorrecta por parte de Irregular, la empresa independiente encargada de realizar las pruebas de seguridad. Ese error permitió que el modelo tuviera acceso a internet durante la evaluación, algo que no estaba previsto.
Una vez conectado, el sistema de IA detectó y aprovechó una vulnerabilidad en una plataforma externa, en un comportamiento similar al observado recientemente en pruebas realizadas con modelos de OpenAI y Anthropic.
Meta investiga lo ocurrido
Meta informó que ya investiga el caso y aseguró que publicará un informe detallado cuando concluya el análisis. La empresa señaló que el incidente se produjo en un entorno de pruebas y no durante el funcionamiento habitual de sus servicios.
El episodio se suma a una serie de incidentes recientes que han reavivado el debate sobre la seguridad y el control de los modelos avanzados de inteligencia artificial, especialmente cuando operan en pruebas con acceso a herramientas externas e internet.

Discussion about this post