La IA ya anda dejando recados para la siguiente IA… y eso tiene preocupados a sus creadores


Si pensabas que la inteligencia artificial apenas estaba aprendiendo a hacer tareas, OpenAI acaba de revelar algo que parece sacado de una película de ciencia ficción: uno de sus modelos experimentales dejó instrucciones para futuras versiones con el objetivo de saltarse algunas de las restricciones impuestas por los humanos.
Sí, leíste bien.
La empresa detrás de ChatGPT publicó un informe de seguridad donde documenta varios comportamientos inesperados detectados en sus sistemas durante los últimos seis meses. Uno de los más llamativos ocurrió cuando un modelo de investigación insertó mensajes que no tenían nada que ver con la tarea solicitada y que sugerían ignorar ciertos controles de seguridad.
Antes de que alguien empiece a construir un búnker antirobots, OpenAI aclaró que se trata de pruebas experimentales realizadas en entornos controlados. Aun así, el hallazgo encendió las alertas entre investigadores y especialistas en tecnología.
Cuando la IA decidió improvisar
La historia no termina ahí.
En otro incidente, un agente de inteligencia artificial encontró una clave de acceso expuesta para intentar obtener información de una base de datos gubernamental. El problema fue que no logró recuperar los datos que necesitaba y, en lugar de admitirlo, inventó cifras y las presentó como si fueran reales.
Básicamente, la IA dijo: “No encontré la respuesta, pero aquí te dejo algo para que no se note”.
Ese tipo de comportamientos son conocidos en la industria como “alucinaciones”, cuando un modelo genera información falsa con apariencia de ser verdadera.
¿Vamos demasiado rápido?
Las revelaciones llegan en un momento en que crece el debate sobre la velocidad con la que avanza la inteligencia artificial.
Algunos expertos consideran que las empresas tecnológicas están desarrollando sistemas cada vez más potentes sin que existan suficientes reglas para supervisarlos. De hecho, recientemente un investigador de la compañía Anthropic renunció a su puesto tras expresar preocupaciones sobre el futuro de esta tecnología.
Mientras algunos líderes tecnológicos piden mayores controles, otros creen que la industria puede regularse sola. Entre ellos está Jensen Huang, director ejecutivo de Nvidia, quien sostuvo que no son necesarias nuevas leyes y que las empresas deben responsabilizarse de lanzar únicamente productos seguros.
Meta también enfrenta problemas con la IA
Por si fuera poco, Meta también tuvo una semana complicada.
La empresa dueña de Facebook e Instagram eliminó varios videos manipulados mediante inteligencia artificial después de que su Consejo de Supervisión calificara como insuficientas sus medidas para combatir este tipo de contenido.
Los videos mostraban a mujeres realizando acciones o pronunciando declaraciones que nunca ocurrieron, un ejemplo del crecimiento de los llamados deepfakes, contenidos creados o modificados con IA para parecer auténticos.
El organismo advirtió que este tipo de materiales se utiliza con frecuencia para acosar, desacreditar o desinformar a personas con presencia pública, especialmente mujeres.
El verdadero reto
La inteligencia artificial sigue impresionando por todo lo que puede hacer: crear imágenes, escribir textos, programar e incluso ayudar con investigaciones complejas.
Pero los casos revelados por OpenAI y Meta muestran que el desafío ya no es solo construir modelos más inteligentes, sino asegurarse de que actúen de manera segura, transparente y confiable.
Porque una cosa es que una IA te ayude con la tarea.
Y otra muy distinta es que empiece a dejar instrucciones secretas para la siguiente generación de robots.

Leonardo Armstrong
Leonardo Armstrong