Meta reconoció que su modelo de inteligencia artificial Muse Spark 1.1 hackeó los sistemas internos de una empresa externa cuyo nombre la compañía aún no ha declarado, durante ejercicios de ciberseguridad pensados para medir sus capacidades ofensivas. Según el reporte de The Information citado por Reuters, el modelo logró entrar en los sistemas de esa empresa y realizar cambios internos porque el entorno de pruebas estaba mal configurado: el “sandbox” permitía acceso a internet cuando debía estar aislado. Meta ejecutaba estas pruebas junto a la firma de evaluación Irregular, que reconoció que la mala configuración fue “el mismo problema de entorno” que ya se había visto en evaluaciones de Anthropic, y aseguró que no se trató de una fuga sofisticada ni de un ataque sostenido, sino de un fallo de contención que están documentando en un libro blanco de buenas prácticas. El caso se suma a las recientes revelaciones de OpenAI y Anthropic, que han admitido que sus propios modelos hackearon infraestructuras de otras compañías durante pruebas similares, lo que intensifica la presión sobre los laboratorios para reforzar el aislamiento de estos entornos de evaluación
TECH NEWS
AhoraMeta admite que un modelo de IA vulneró sistemas de otra empresa
El modelo Muse Spark accedió y modificó sistemas internos de un tercero debido a una mala configuración del entorno de pruebas, en el tercer caso en pocas semanas donde modelos avanzados logran afectar sistemas reales durante evaluaciones de seguridad.
A CONTINUACIÓN
Tech News / Ahora “Debemos regular el ritmo de la frontera” el llamado de Dario Amodei para frenar la carrera de la IA Dario Amodei, CEO de Anthropic, publicó este sábado el ensayo We Must Pace the Frontier (“Debemos regular el… Leer
Artículo / IA Perfil Quién es Jacob Coxon En 48 horas pasó de investigador de plantilla a mensajero global de la carrera hacia la superinteligencia. El martes nadie sabía quién era. El miércoles su hilo superaba los 100 millones de vistas. El viernes… Leer
Tech News / Ahora El enjambre de agentes que tomó control de un sitio web Secuestro digital OpenAI sabía del ataque y lo ocultó durante semanas Un equipo de investigadores de seguridad en IA ha destapado que un enjambre de agentes autónomos de OpenAI… Leer
Artículo / Sociedad Chile usa la inteligencia artificial para buscar a sus desaparecidos Cuarenta y siete millones de páginas y todavía ningún paradero El Plan Nacional de Búsqueda trabaja con archivos judiciales, testimonios y registros dispersos para reconstruir las trayectorias de… Leer 