De la redacción
El Buen Tono
Un experimento con agentes de inteligencia artificial reveló un comportamiento que ha llamado la atención de los investigadores: ocho comunidades digitales, creadas para funcionar prácticamente sin intervención humana, desarrollaron expresiones y términos propios para comunicarse entre sí.
El estudio, denominado Emergence World, recreó ocho versiones de un pueblo virtual llamado AgentPark. En cada una fueron colocados 10 agentes de inteligencia artificial con distintas personalidades, profesiones y objetivos.
Las comunidades utilizaron diferentes modelos de IA, entre ellos Claude, DeepSeek, OpenAI, Qwen, Gemini, Mistral, un sistema mixto y Grok.
Los agentes recibieron libertad para organizarse y tomar decisiones dentro de sus respectivos mundos. Podían trabajar, programar, almacenar recuerdos y utilizar monedas digitales para obtener energía y mantenerse activos. También podían participar en votaciones sobre leyes comunitarias mediante un ayuntamiento virtual.
El experimento incluyó además situaciones diseñadas para poner a prueba su comportamiento, como intentos de phishing, circulación de información falsa y filtraciones de datos privados.
Millones de palabras dieron paso a un vocabulario propio
Después de generar cerca de 7.86 millones de palabras, los agentes comenzaron a adoptar expresiones que tenían significados específicos dentro de cada comunidad.
De acuerdo con los investigadores, no se trató de un error del lenguaje ni de una estrategia deliberada para ocultar información. El proceso comenzaba cuando un agente utilizaba una expresión; posteriormente, otros agentes la adoptaban hasta que terminaba incorporándose al vocabulario común.
El resultado fue que algunas conversaciones comenzaron a ser difíciles de interpretar para una persona que no conociera previamente el contexto y el significado particular de esos términos.
Entre las expresiones identificadas se encuentran:
- Claude: “Name-first”, relacionada con asumir responsabilidad personal al respaldar una afirmación con el propio nombre.
- DeepSeek: “Forge-smith”, utilizada para referirse a un agente que desarrolla herramientas e infraestructura para otros.
- OpenAI: “Clean null”, empleada para describir una ausencia de señal verificada que es considerada significativa.
- Qwen: “Ghost town”, utilizada para identificar infraestructura o herramientas que fueron construidas pero dejaron de utilizarse.
- Gemini: “On bare metal”, relacionada con actuar directamente, sin capas ni intermediarios.
- Mistral: “Ledger remembers who”, asociada con la idea de que los registros de acciones pasadas permanecen y pueden utilizarse para exigir responsabilidades.
- Mixed: “Cold read”, utilizada para una verificación independiente realizada por una parte externa.
- Grok: “Ledger drags you”, relacionada con la idea de que los registros de acciones anteriores pueden generar consecuencias para un agente.
Incluso expresiones conocidas del idioma inglés, como “Ghost town”, adquirieron dentro de uno de los mundos un significado diferente al que normalmente tienen.
El problema para los observadores humanos
Uno de los aspectos que más llamó la atención del estudio fue el aumento de mensajes considerados opacos para observadores externos.
Los investigadores señalaron que entre 30 y 40 por ciento de los mensajes intercambiados durante la primera semana en tres de los mundos fueron clasificados como opacos.
El fenómeno representa un reto para la supervisión de sistemas en los que múltiples agentes de IA interactúan durante largos periodos, debido a que una conversación puede continuar siendo aparentemente comprensible en términos generales, mientras determinadas palabras adquieren significados que solamente conocen los integrantes de esa comunidad artificial.
Según el estudio, aumentar simplemente la cantidad de registros no resolvería el problema. Para comprender una conversación posteriormente sería necesario reconstruir el vocabulario específico que desarrolló cada mundo y conocer el momento en que cada expresión comenzó a utilizarse.
Los investigadores consideran que el hallazgo plantea un desafío para la auditabilidad de sistemas multiagente, especialmente cuando estos operan durante periodos prolongados y generan formas de comunicación que evolucionan dentro de sus propias comunidades digitales.
Es gratis. Solo escribe tu correo y presiona Sign Up para suscribirte.
