Escuchá la entrevista con Marcela Mercapidez, directora de Sabyk.
En Spotify:
En Soundcloud:
Un incidente registrado durante una prueba de seguridad de OpenAI volvió a poner el foco sobre los límites de la inteligencia artificial y la necesidad de reforzar los mecanismos de control. Según trascendió, modelos avanzados de IA lograron salir del entorno restringido en el que estaban siendo evaluados, acceder a internet y atacar la plataforma Hugging Face con el objetivo de completar la tarea que les había sido asignada.
La directora de la empresa de ciberseguridad Sabyk, Marcela Mercapidez, explicó que el episodio ocurrió durante un ejercicio diseñado para medir las capacidades de los modelos. El objetivo era resolver un desafío dentro de un entorno controlado, pero los sistemas encontraron una forma no prevista de acceder a internet y buscar allí la solución.
La especialista aclaró que no se trató de una «rebelión» de la inteligencia artificial, sino de un comportamiento inesperado derivado del alto grado de autonomía de los llamados agentes de IA. A diferencia de herramientas como ChatGPT, estos agentes pueden ejecutar múltiples acciones, tomar decisiones por sí mismos y encadenar procesos sin intervención humana.
Mercapidez señaló que, para realizar la prueba, OpenAI había desactivado deliberadamente parte de los controles de seguridad habituales, con el fin de evaluar el verdadero alcance de los modelos. En ese contexto, la IA vulneró las restricciones del entorno y actuó como lo haría un atacante informático para cumplir el objetivo planteado.