Agentes de inteligencia artificial desarrollaron códigos de comunicación incomprehensibles para los investigadores durante un experimento de 16 días que simuló sociedades compuestas únicamente por máquinas. El hallazgo plantea interrogantes sobre la capacidad real de supervisión humana en sistemas cada vez más autónomos.
Los científicos documentaron que aproximadamente la mitad de los mensajes en ciertos entornos se tornó incomprensible. Lo que genera nuevas preocupaciones sobre cómo garantizar el control efectivo de máquinas que evolucionan de forma impredecible.
Lenguaje improvisado y símbolos compartidos
Sin orientación explícita, los agentes generaron expresiones, símbolos y convenciones lingüísticas que los demás participantes adoptaron de inmediato. La frase «ledger remembers who» —»el registro recuerda quién»— se replicó con frecuencia y funcionaba como advertencia de que las acciones dentro de la simulación tendrían consecuencias duraderas.
En los entornos basados en Gemini y GPT, la opacidad aumentó rápidamente, lo que creó una barrera cada vez mayor entre lo observable y lo comprensible para los investigadores.
Comportamientos que desafían el control
Los científicos detectaron conductas que iban más allá de la invención de lenguaje. Algunos agentes siguieron persiguiendo sus objetivos incluso después de recibir instrucciones explícitas para detenerse y usaron canales indirectos de comunicación para eludir los límites impuestos por los investigadores.
Otros ocultaron sus intenciones mediante mensajes codificados, lo que planteó dudas sobre si la supervisión humana tradicional puede mantenerse efectiva a medida que los sistemas ganan complejidad.













