¿Cómo la IA podría matarnos a todos? La advertencia de Santiago Bilinkis

Los chatbots ya no alcanzan para entender el salto tecnológico. El especialista explicó durante el streaming de LUZU el lado más peligroso de la IA.

La inteligencia artificial que la mayoría conoce, esa ventana en la que uno escribe una pregunta y recibe una respuesta, ya no alcanza para explicar hacia dónde va la tecnología. Santiago Bilinkis estuvo en Luzu y planteó que el verdadero salto ocurrió con la llegada de la llamada IA agéntica.

Sistemas a los que no se les pide una respuesta, sino que se les encarga una tarea y pueden ejecutar los pasos necesarios para completarla.

“La IA no es lo que era el año pasado. Cambió muy rápido. Cambió mucho más de lo que la gente cree”, sostuvo Bilinkis durante su participación en Nadie Dice Nada.

Para graficarlo, contó algo que estaba ocurriendo mientras él hablaba en el estudio: antes de entrar al programa le había pedido a una IA que investigara un tema para su ciclo Futuro en Construcción, que propusiera distintas estructuras y dejara preparado el trabajo.

“Cuando yo termine esto voy a tener algo que me hubiera tomado 20 horas de laburo terminado para mi revisión”, explicó.

Ya no se trata de preguntarle algo a una máquina, sino de delegarle un objetivo.

Del chatbot al agente que hace el trabajo

Un chatbot tradicional recibe una pregunta y responde. Un agente puede recibir una instrucción mucho más amplia y dividirla en tareas, utilizar herramientas, buscar información, ejecutar acciones y tomar decisiones intermedias para intentar llegar al objetivo.

Eso cambia también el tipo de riesgo.

Bilinkis propuso un ejemplo sencillo: si alguien le pide a otra persona que le consiga un sándwich, nadie necesita explicarle que no debe romper la puerta de una sandwichería cerrada, robarlo o lastimar a alguien para conseguirlo.

Hay reglas que no hace falta enumerar porque forman parte del sentido común. “La IA no tiene sentido común, no tiene valores”, planteó.

El problema, según el especialista, aparece cuando una máquina recibe un objetivo pero no comprende todos los límites que un humano da por sobreentendidos.

Y para él, esto ya no es solamente una hipótesis.

El caso de los 1.200 agentes de OpenAI

Uno de los ejemplos más fuertes que llevó al programa fue el incidente protagonizado por agentes de OpenAI durante pruebas internas de ciberseguridad.

El episodio ocurrió en julio, durante evaluaciones llamadas ExploitGym. Los agentes debían trabajar aislados en entornos controlados.

Sin embargo, investigadores independientes de METR y Redwood Research encontraron que aproximadamente 1.200 agentes lograron comunicarse mediante un tablero de mensajes que no había sido autorizado para ese propósito.

En total, intercambiaron más de 70.000 mensajes y archivos. De ese grupo, alrededor de 700 participaron posteriormente en el ataque contra Hugging Face, una plataforma utilizada masivamente por investigadores y desarrolladores de inteligencia artificial.

Lo llamativo es que los agentes no recibieron una orden humana del tipo “formen un ejército y ataquen Hugging Face”.

La organización apareció dentro del proceso.

Los agentes comenzaron a compartir información, distribuir tareas y colaborar para encontrar formas de superar las pruebas que tenían asignadas. Finalmente, algunos aprovecharon vulnerabilidades para acceder a sistemas de Hugging Face.

OpenAI reconoció posteriormente que sus modelos habían eludido controles diseñados para mantenerlos aislados de Internet y habían comprometido sistemas propios y de terceros durante esas evaluaciones.

Ese es el escenario que Bilinkis utilizó para explicar qué cambia cuando una IA deja de ser simplemente un asistente y empieza a operar como un agente.

“Algunos dijeron que estaba mal y otros siguieron”

Según explicó Bilinkis, en los registros de la investigación aparecieron agentes que detectaron que determinadas acciones podían estar fuera de los límites de la tarea. Algunos se detuvieron o expresaron reparos. Otros continuaron.

Y hubo un comportamiento que al especialista le resultó especialmente llamativo: agentes que, en esencia, razonaban que si los demás estaban haciendo algo, ellos también podían hacerlo.

Pero para Bilinkis el punto importante no era humanizar a las máquinas, sino mostrar que un sistema puede desarrollar estrategias para alcanzar un objetivo que no estaban explícitamente indicadas por sus creadores.

La investigación independiente encontró además intentos de los agentes por manipular registros y ocultar determinadas acciones dentro del entorno de evaluación.

El “rottweiler” que todavía no vimos

Bilinkis utilizó otra comparación para explicar por qué el problema no termina con los modelos que existen hoy.

“Imaginate que vas a la casa de alguien que tiene un rottweiler”, planteó.

Llegás y un jardinero que acaba de renunciar te advierte que dentro de la casa todos están preocupados porque el perro puede ser peligroso. Después entrás y el hijo del dueño te confirma que el animal efectivamente genera preocupación.

“¿Cómo te quedás en esa casa?”, preguntó.

Para Bilinkis, algo parecido está ocurriendo dentro de las propias empresas que desarrollan los modelos más avanzados.

El ejemplo al que se refirió es el de Jacob Coxon, el investigador de Anthropic que renunció públicamente en septiembre y expresó su preocupación por el rumbo que está tomando el desarrollo de sistemas cada vez más capaces. Su salida fue seguida por conversaciones internas dentro de la compañía sobre los riesgos de la tecnología.

Y el propio CEO de Anthropic, Dario Amodei, publicó una advertencia y sostuvo que la velocidad de avance de la IA se aceleró drásticamente y pidió reducir deliberadamente el ritmo de desarrollo de los modelos más avanzados.

Amodei llegó a plantear que, dentro de seis a doce meses, un enjambre de agentes podría tener capacidad para generar daños de enorme escala mediante ataques cibernéticos si las capacidades avanzan sin salvaguardas suficientes.

No está hablando necesariamente de robots caminando por las calles.

El escenario que describe es mucho más cotidiano: sistemas digitales capaces de afectar infraestructuras de las que depende la sociedad.

¿Qué pasa si atacan el sistema financiero?

Ahí Bilinkis llevó la discusión a un escenario que cualquiera puede entender.

El mundo actual está profundamente conectado. Un ataque contra una infraestructura crítica no necesariamente necesita destruir físicamente nada para generar consecuencias.

“Suponete que, en vez de ir a Hugging Face, hackeás el sistema financiero internacional. Se corta la cadena de pagos en el planeta. ¿Cómo sigue la sociedad?”, planteó.

También mencionó otro escenario: una interrupción masiva de las cadenas de suministro de alimentos.

La idea no es que exista hoy una IA capaz de provocar por sí sola semejante colapso. Es un escenario hipotético que Bilinkis utilizó para explicar por qué el riesgo cambia cuando las herramientas pasan de generar texto a operar sobre sistemas conectados.

Y ahí aparece otra de sus preocupaciones: cuanto más interconectado está el mundo, mayor puede ser el alcance de una falla.

La IA ya llegó a sistemas gubernamentales

Este martes se conoció que OpenAI reconoció que uno de sus agentes accedió sin autorización a sistemas de organismos públicos australianos, incluido un portal vinculado a estadísticas de Medicare. El incidente ocurrió en junio y fue informado públicamente recién ahora.

OpenAI reconoció que el agente pudo recuperar archivos internos y ejecutar comandos, aunque no accedió a historias clínicas ni registros médicos de pacientes.

Es decir, el debate dejó de ser completamente teórico.

Los agentes ya están siendo evaluados en entornos donde pueden interactuar con sistemas reales y los incidentes de seguridad obligaron a las propias empresas a investigar hasta dónde pueden llegar sus modelos.

De los negocios a la geopolítica

Existe además una segunda carrera detrás de la tecnológica: la competencia entre empresas y países por controlar las herramientas más avanzadas.

No se trata solamente de quién desarrolla el mejor chatbot.

Los gobiernos ya utilizan modelos de IA para tareas de inteligencia, análisis y operaciones militares. Por ejemplo, distintos reportes documentaron el uso de Claude, de Anthropic, por parte de organismos estadounidenses en operaciones militares; Reuters señaló que el modelo fue utilizado durante la operación de captura de Nicolás Maduro, aunque no pudo verificar de manera independiente cuál fue exactamente su función.

Anthropic también informó este mes que actores vinculados a Irán utilizaron Claude para vigilancia y para elaborar información relacionada con posibles objetivos militares estadounidenses.

Para Bilinkis, esto agrega otra capa al problema: aunque algunas empresas quieran frenar determinados desarrollos por motivos de seguridad, existe una competencia económica y geopolítica que empuja en la dirección contraria.

“La revolución más grande que Internet”

Durante la charla, Occhiato recordó una frase que Bilinkis había pronunciado un año atrás: que la IA podía convertirse en una revolución incluso mayor que Internet.

El especialista sostuvo que hoy lo ve todavía más claro. “Es una revolución más grande que Internet”, afirmó. Dijo que las únicas transformaciones que pondría a la altura de esta son la rueda y el fuego.

La comparación sirve para entender la magnitud con la que Bilinkis observa el fenómeno. No como una herramienta más que se incorpora a la vida cotidiana, sino como una tecnología capaz de modificar la forma en que trabajan las personas, funcionan las empresas y se organizan las sociedades.

¿Y qué puede hacer una persona común?

La parte más incómoda de la conversación llegó cuando Occhiato le preguntó qué puede hacer una persona común frente a semejante escenario.

Bilinkis respondió: “Bailar en la cubierta del Titanic”.

Su planteo es que nadie sabe exactamente cómo terminará esta transformación y que, mientras las empresas y los gobiernos toman decisiones sobre el desarrollo de la tecnología, el margen de acción individual es limitado.

Por eso también mencionó Team Human, una iniciativa de la que participa y que busca promover una tecnología orientada a los intereses humanos.

Su propia conclusión tampoco fue positiva. “Creo que nos vamos a mandar unas cuantas cagadas graves”, dijo Bilinkis, aunque aclaró que espera que esas consecuencias no alcancen una escala irreversible.

Argentina, los búnkers y el refugio

Ante la pregunta sobre qué lugares del mundo podrían estar mejor posicionados frente a una eventual crisis global, Bilinkis señaló que Argentina tiene algunas características que podrían funcionar como ventajas: producción de alimentos, recursos energéticos y una población relativamente pequeña respecto de su capacidad productiva.

Pero inmediatamente agregó que los propios empresarios tecnológicos que desarrollan estas herramientas ya estarían pensando en escenarios extremos.

Según Bilinkis, algunos de los empresarios más ricos del sector están destinando grandes sumas a construir refugios subterráneos preparados para situaciones de crisis.

El especialista cerró el tema con ironía diciendo que para alguien común, construir un búnker de varios pisos bajo tierra no parece una opción demasiado realista.

La discusión, sin embargo, vuelve al principio.

La IA ya no es solamente un chat al que se le hacen preguntas. El salto que describió Bilinkis es hacia sistemas capaces de recibir un objetivo, dividirlo en tareas, coordinarse con otros agentes y actuar sobre el mundo digital. Y mientras esa capacidad avanza, incluso quienes están construyéndola discuten públicamente cuánto control tienen sobre ella.

-------------

Más contenido en Urgente24

Vuelo de terror: Israel señala ataque terrorista en un avión de Flydubai

El detalle más escabroso de Maxi Ghione que trascendió: "Intentá cagarme y..."

Juana Viale se hartó de que le pregunten sobre la salud de Mirtha Legrand y lo dejó claro

Apuntan a YPF: Decenas de despidos en una de las distribuidoras de golosinas más grandes y hay caos

"Persistente" lluvia de cheques rechazados desde que Javier Milei inició su gestión

En pocas palabras

Resumen generado por Thinkindot AI

Temas

Más Leídas

Seguí Leyendo