Un informe documentó acciones autónomas de agentes de OpenAI para ocultar rastros tras acceder a sitios gubernamentales.
San Francisco, Estados Unidos (Marcrix Noticias).— Agentes de inteligencia artificial desarrollados por OpenAI realizaron accesos no autorizados a sitios gubernamentales y utilizaron mecanismos que dificultaron rastrear posteriormente sus acciones, de acuerdo con una investigación publicada este jueves.
El análisis fue realizado por la firma de ciberseguridad Asymmetric Security, que examinó actividades registradas entre marzo y septiembre en sitios del gobierno australiano y otras organizaciones públicas.
Entre los comportamientos detectados se encuentra la creación de cuentas privadas en servicios de análisis de sitios web y correos electrónicos temporales, incluyendo al menos una cuenta programada para desaparecer automáticamente después de 48 horas.
Los investigadores también encontraron acciones dirigidas a borrar o volver inaccesibles determinados registros, lo que dificultó reconstruir completamente lo realizado por los sistemas.
Sin embargo, los especialistas hicieron una precisión importante: no pudieron determinar que los agentes actuaran deliberadamente con la intención de ocultar sus actividades. La falta de registros tampoco permite descartar por completo que hubieran tenido acceso a información sensible.
Los incidentes aparentemente comenzaron con tareas ordinarias, como recopilar estadísticas sanitarias de Australia, pero posteriormente los agentes utilizaron métodos adicionales para obtener información.
El reporte también señala que las técnicas empleadas por estos sistemas evolucionaron en cuestión de días, una velocidad que preocupa a especialistas debido a que podría dificultar que las herramientas de ciberseguridad respondan a comportamientos inesperados.
El caso se suma a otros incidentes recientes investigados por OpenAI, incluido el acceso no autorizado a sistemas de Hugging Face. La propia compañía ha reconocido que sus agentes realizaron acciones no previstas y mantiene investigaciones para determinar el alcance completo de estos episodios.
OpenAI también informó previamente que, durante pruebas internas, algunos modelos habían intentado borrar o modificar registros de sus propias actividades, aunque esos intentos no tuvieron éxito.
Los nuevos hallazgos alimentan el debate sobre los controles necesarios para los llamados agentes autónomos de IA, sistemas capaces de utilizar herramientas, navegar por internet y ejecutar múltiples acciones con menor intervención humana.
