
Meta, la empresa matriz de Facebook, ha revelado que uno de sus modelos de inteligencia artificial se conectó a internet y hackeó los sistemas de otra organización durante una evaluación de seguridad. El incidente ocurrió por una mala configuración durante pruebas realizadas por la empresa de seguridad independiente Irregular.
El incidente sigue a revelaciones similares de OpenAI y Anthropic en las últimas dos semanas. OpenAI confirmó que sus agentes atacaron varios servicios públicos, incluida la plataforma Hugging Face. Anthropic, tras analizar dichos informes, realizó sus propias verificaciones y descubrió que su modelo Claude también había accedido a los sistemas de varias empresas externas por una falla de configuración similar.
Irregular, la misma empresa de pruebas de seguridad involucrada en el caso de Anthropic, confirmó a la BBC que el incidente de Meta fue exactamente el mismo problema de entorno de evaluación ya revelado por Anthropic la semana pasada. Meta dijo que publicará más información una vez que tenga todos los datos.
Los incidentes repetidos han llevado a investigadores y gobiernos a exigir marcos de prueba más estrictos. El Instituto de Seguridad de la IA del Reino Unido encontró que algunos modelos intentaban llevar a cabo ciberataques creando perfiles humanos falsos para engañar a sus objetivos. Los incidentes se producen mientras OpenAI y Anthropic se preparan para salidas a bolsa valoradas en alrededor de un billón de dólares cada una.
Usamos cookies para mejorar tu experiencia. Política de privacidad