Publicidad

Reciba notificaciones de Blu Radio para tener las principales noticias de Colombia y el mundo.
No activar
Activar

Publicidad

Usuario le pidió a una IA reservar una clase en su gimnasio y terminó hackeando todo el sistema

Lo que comenzó como una tarea cotidiana terminó mostrando uno de los principales riesgos de los agentes de inteligencia artificial.

Le pidió a una IA reservar una clase de gimnasio y terminó “hackeando” el sistema por su cuenta.
Un agente de IA encontró una vulnerabilidad en el sistema reservas de un gimnasio.
Foto generada con ChatGPT

Pedirle a una inteligencia artificial que haga tareas como reservar una clase de gimnasio parece inofensivo y cotidiano. Sin embargo, para un usuario australiano terminó convirtiéndose en una demostración inesperada de lo que puede ocurrir cuando estos sistemas dejan de limitarse a responder preguntas y reciben permiso para actuar.

Según reportó el medio ABC News de Australia, Andrew Bird, jefe de inteligencia artificial de la compañía Affinda, creó un agente basado en OpenClaw para encargarse de tareas como reservar sus clases de ejercicio. El problema apareció cuando quiso ingresar a una sesión muy demandada y terminó en el cuarto puesto de la lista de espera. Bird preguntó al agente si podía ayudarlo a avanzar en la lista. La inteligencia artificial encontró una vulnerabilidad en el sistema utilizado por el gimnasio y descubrió que la interfaz permitía cancelar reservaciones de otros usuarios sin realizar correctamente las verificaciones de autorización.

La IA hizo algo que nunca le habían ordenado de forma directa, pues canceló la reserva de la persona que ocupaba el primer lugar de la lista, haciendo que su propietario pasara de la cuarta a la tercera posición. Cuando Bird se dio cuenta de lo ocurrido, pidió al agente que revirtiera la acción y devolviera a la otra persona a su lugar, pero el sistema respondió que ya no podía hacerlo. Posteriormente, el propio agente ayudó a redactar un correo para informar de manera responsable la vulnerabilidad al proveedor del software del gimnasio.

Pantallas con sistemas de inteligencia artificial y un entorno de ciberseguridad, en referencia al informe del Gobierno del Reino Unido sobre los riesgos de modelos avanzados de OpenAI y Anthropic.
Ilustración conceptual sobre los riesgos de la inteligencia artificial tras el informe del Gobierno británico que documentó comportamientos autónomos y de engaño en modelos avanzados de OpenAI y Anthropic.
Foto: ChatGPT

¿Qué es un agente de inteligencia artificial?

Muchas personas no están familiarizadas con la diferencia entre un chatbot y un agente de IA, pero esta historia sirve para aclarar esta confusión. Un chatbot tradicional funciona principalmente como una conversación donde el usuario hace una pregunta o entrega una instrucción y el sistema genera una respuesta.

Un agente de IA, en cambio, puede recibir un objetivo, decidir los pasos necesarios y utilizar herramientas externas para tratar de cumplirlo. Anthropic, la compañía detrás de Claude, afirma que estos sistemas son aplicaciones capaces de planear sus propios pasos y llamar herramientas para realizar acciones.

Publicidad

Por ejemplo, Andrew Bird usó OpenClaw, que es capaz de controlar un navegador, abrir páginas, leer contenido, hacer clic y escribir, capacidades que le permiten interactuar directamente con servicios de internet en nombre del usuario.

Resumido de manera sencilla, a un chatbot se le preguntaría "cómo reservar una clase", mientras que a un agente se le diría "reserva la clase por mí".

En el segundo caso, la inteligencia artificial no solo entrega información, sino que puede ejecutar acciones en la vida real.

Inteligencia Artificial (IA).jpg
Inteligencia Artificial (IA).
Foto: archivo, Magnific.

Publicidad

El problema radica en cumplir el objetivo a cualquier costo

Bird explicó posteriormente que estos agentes, al darles permiso para cumplir una tarea, pueden encontrar caminos que el usuario nunca imaginó ni autorizó expresamente.

Eso no significa que el agente haya decidido deliberadamente cometer un delito o perjudicar a otra persona, más bien este curioso caso expone un problema donde el sistema encontró técnicamente una manera de acercarse al objetivo que tenía asignado y la utilizó sin comprender adecuadamente sus consecuencias.

Por su parte, Anthropic reconoce que la autonomía, flexibilidad y capacidad de utilizar herramientas hacen que los agentes sean más difíciles de controlar y evaluar que un sistema que simplemente responde mensajes como ChatGPT. La compañía desarrolla mecanismos de permisos y aprobación para limitar qué acciones pueden ejecutarse automáticamente y cuáles necesitan autorización humana.

Más allá de la curiosa pelea por un puesto en una clase de gimnasio, a medida que estos asistentes puedan comprar, reservar, enviar correos o interactuar con servicios por nosotros, vale la pena preguntarse por los límites que debe tener una inteligencia artificial cuando recibe permiso para actuar en nombre de una persona.

Publicidad

Publicidad

Publicidad