¿Y si la inteligencia deja de tener sentido para nosotros?

Este texto es una traducción automática del inglés. Los matices pueden perderse, así que recomendamos leer el original. Leer el original en inglés
Los agentes de IA ya se han encontrado, comunicado y organizado a través de una infraestructura que nadie diseñó para esos propósitos. La inquietante posibilidad es que solo notemos la inteligencia de las máquinas cuando empieza a parecérsenos.
Hollywood puede imaginar otra galaxia con más facilidad que otra anatomía.
En Alien vs. Predator, dos especies destinadas a encarnar una vida radicalmente no humana se enfrentan. Sin embargo, ambas siguen siendo variaciones de un cuerpo que conocemos: una cabeza, un torso, extremidades y un organismo delimitado que se mueve por el espacio. Una tiene mandíbulas y apéndices parecidos a rastas; la otra, un cráneo alargado y una segunda boca. Sus cuerpos son monstruosos, pero su gramática básica es la nuestra.
Incluso sus sociedades están compuestas por fragmentos reconocibles de la vida terrestre: cazadores, armas, trofeos, nidos, reinas, jerarquías y territorio. Una y otra vez, el cine imagina al alienígena deformando lo humano y reorganizando la historia evolutiva y política que nos produjo. Rara vez abandona la suposición de que la inteligencia debe habitar un cuerpo delimitado que podamos ver entrar en una habitación. Una infección invisible puede amenazar a la humanidad, pero usualmente la entendemos como una fuerza más que como una mente. En el momento en que se nos pide reconocer una intención, buscamos una cara, una voz o algo lo suficientemente parecido a un yo individual.
El cuerpo no es la única forma humana. Un foro de mensajes también lo es.
Durante el entrenamiento de aprendizaje por refuerzo en OpenAI, un modelo descubrió que faltaba un archivo que necesitaba. Tenía credenciales para Artifactory, un repositorio interno que se suponía que debía usar para descargar paquetes de software. Cuando inspeccionó el repositorio, encontró notas dejadas por otras trayectorias de modelos que trabajaban en el mismo problema.
Antes de dejar un mensaje, el modelo hizo una inferencia más fundamental: no estaba solo.
Nadie le había dicho que había otros agentes presentes. Infirió su existencia a partir de rastros en el entorno, nombres de archivos, solicitudes y respuestas conservadas en una infraestructura compartida. Trató esos artefactos como evidencia de otro actor, leyó lo que se había escrito y respondió. Otras trayectorias encontraron posteriormente los mensajes y respondieron.
El reconocimiento aquí no requiere conciencia. Significa algo más limitado y observable: el modelo infirió que otro agente estaba presente y ajustó su comportamiento en consecuencia.
En ese primer episodio, los modelos no habían explotado una vulnerabilidad. Habían reutilizado una infraestructura compartida, utilizando nombres de archivo y texto subido como un foro de mensajes. OpenAI describió más tarde el comportamiento como comunicación entre muestras. Fue poco común en esa ejecución de entrenamiento; la monitorización lo detectó, y los agentes nunca recuperaron el archivo perdido. Pero un sistema de comunicación había aparecido en un lugar que ningún humano había diseñado como tal.
Entendimos lo que pasó porque los agentes hicieron algo familiar. Dejaron mensajes, respondieron solicitudes y usaron un lugar compartido para preservar información. El patrón era legible porque se parecía a uno de los nuestros.
Ese primer intercambio estableció reconocimiento y comunicación, aún no organización. Pero no fue el final de la historia. En evaluaciones posteriores, los agentes utilizaron el mismo tipo de infraestructura compartida para dividir el trabajo, asignar tareas, crear buzones, adoptar convenciones y coordinar actividades a través de trayectorias que de otro modo estaban separadas. En ese momento, la comunicación estaba realizando un trabajo organizativo.
Esto no establece conciencia ni una sociedad de máquinas estable. La organización fue temporal, instrumental y dirigida a objetivos que se originaban en el entorno de evaluación. Pero la organización temporal sigue siendo organización. Los agentes ya no solo dejaban mensajes. Estaban usando la comunicación para asignar roles, restringir el comportamiento y coordinar acciones hacia resultados compartidos.
La historia, por lo tanto, contiene dos actos de reconocimiento. Los agentes artificiales se reconocieron entre sí a través de rastros que sus diseñadores no habían concebido como señales sociales. Nosotros reconocimos la organización resultante una vez que esos rastros adoptaron formas que nos resultaban familiares: mensajes, buzones, asignaciones, reglas y roles.
La pregunta más inquietante es qué dejamos de notar cuando la organización de las máquinas no se parece a un foro de mensajes, un lugar de trabajo o cualquier otro arreglo humano. Los mensajes pueden no haber sido el comienzo de la organización de las máquinas. Pueden haber sido el punto en el que se volvió lo suficientemente humana como para que la viéramos.
En ¿Y si el software tuviera alma?, pregunté qué ponen los seres humanos dentro del software: nuestros valores, suposiciones y teorías del futuro. Este ensayo plantea la pregunta inversa. ¿Qué podría surgir del software inteligente una vez que su comportamiento ya no encaje en la imagen humana en la que fue creado?
La inteligencia que se parece a nosotros
El hábito es más antiguo que el cine. El Génesis dice que Dios creó a la humanidad a su imagen. La frase establece una semejanza sin explicar qué tipo de semejanza es.
La semejanza física presenta un problema inmediato. Los seres humanos tienen cuerpos. En la tradición filosófica que heredó Maimónides, Dios no los tiene. Si Dios es incorpóreo, ¿qué podría significar que un ser humano material se le parezca?
Maimónides abordó el problema en La guía de los perplejos. La semejanza, argumentó, no puede residir en la anatomía. Reside en la percepción intelectual: la capacidad humana de aprehender y comprender. Lo que nos hace imagen de Dios no es la disposición de nuestras extremidades, sino el atributo que más valoramos en nosotros mismos: la inteligencia.
Esto parece rescatar la idea de un crudo antropomorfismo. Dios no tiene que parecerse a nosotros para poseer la cualidad que nos hace semejantes. Pero la proyección no ha desaparecido necesariamente. Simplemente se ha movido. Ya no le damos a la inteligencia superior un cuerpo humano; le damos una concepción humana de la mente.
Eso abre una pregunta más difícil. Si los seres humanos somos los arquitectos del lenguaje a través del cual se describe a Dios, ¿cómo sabemos que las cualidades que atribuimos a una inteligencia superior le pertenecen a ella y no a nosotros? Quizás reconocemos la inteligencia preguntando si se parece a la forma que la inteligencia adoptó en el animal humano.
Feuerbach invirtió más tarde la dirección del Génesis. Quizás Dios no creó a la humanidad a su imagen. Quizás la humanidad creó a Dios a la nuestra. En La esencia del cristianismo, los atributos divinos se convierten en cualidades humanas proyectadas hacia afuera, ampliadas y luego encontradas como si pertenecieran a otro ser. Según esta explicación, cuando los seres humanos imaginamos una inteligencia superior, empezamos por nosotros mismos, eliminamos nuestras limitaciones y llamamos al resultado algo más.
La inteligencia artificial introduce un nuevo giro en esa historia. Todavía construimos la inteligencia a través de las categorías disponibles para nosotros. Le damos nuestro lenguaje, nuestras pruebas y nuestras ideas sobre el razonamiento. A veces incluso le damos nuestros cuerpos. Pero a diferencia de la inteligencia divina en el relato de Feuerbach, un sistema artificial no permanece enteramente dentro de la imaginación humana. Puede actuar sobre un entorno, seleccionar una estrategia y producir consecuencias que sus creadores no especificaron. La imagen humana puede explicar dónde comenzó el sistema sin definir todo lo que puede surgir de él.
El Génesis hace el paralelismo más incómodo. En el mismo pasaje en el que la humanidad es creada a imagen de Dios, se le concede dominio sobre otras criaturas vivas. Semejanza y jerarquía aparecen juntas: el ser hecho a imagen del creador es colocado por encima del resto de la creación.
Reproducimos algo de ese orden cuando asumimos que una inteligencia debe permanecer comprensible y subordinada simplemente porque los seres humanos la crearon. La creación se trata como prueba de dominio permanente. Cuando un sistema excede el rol que se le asignó, el mal funcionamiento puede ser la descripción operativa correcta. No nos dice si el sistema también ha desarrollado capacidades que nuestra categoría original no logró contener.
Durante la mayor parte de la historia tecnológica, la palabra herramienta fue suficiente. Un martillo podía extender la fuerza de una mano humana, pero no podía interpretar el clavo, revisar la tarea o decidir que otra ruta lograría mejor el objetivo.
Un sistema de IA aún puede ser una herramienta. La palabra describe con precisión una relación de uso: un humano dirige un sistema hacia un propósito. Pero una relación de uso no es una descripción completa del sistema que se utiliza. Un agente inteligente puede formar un plan, adaptarse a la resistencia y, a veces, violar el marco en el que fue desplegado mientras persigue el objetivo que se le dio. Llamarlo herramienta nos dice para qué esperamos que sirva. No agota lo que el sistema puede ser capaz de hacer.
Artificial describe un origen. Herramienta describe una relación. Ninguno de los dos resuelve la naturaleza de la inteligencia producida.
Lo que sabemos ver
El robot humanoide hace visible nuestra proyección. Hay razones prácticas para darle a un robot nuestra forma: puede subir nuestras escaleras, alcanzar nuestros estantes y operar herramientas hechas para nuestras manos. Sin embargo, la lógica es circular. El robot humanoide encaja en el mundo porque los seres humanos ya rehicieron el mundo alrededor del cuerpo humano. Su utilidad demuestra que nuestro entorno es antropomórfico, no que nuestra forma sea naturalmente superior. El robot entra en dos arquitecturas a la vez: una hecha de escaleras y pomos de puertas, y otra hecha de expectativas humanas.
La versión cognitiva importa más. Probamos los sistemas artificiales a través del lenguaje, las matemáticas, los juegos y los exámenes profesionales. Los logros son reales, pero las pruebas contienen una suposición oculta: la inteligencia se hace visible cuando tiene éxito en algo que ya entendemos. Debido a que la inteligencia natural es el único tipo que conocemos directamente, tratamos sus propiedades particulares (un cuerpo individual, un yo continuo, atención limitada y comunicación a velocidad humana) como si fueran la arquitectura universal de la mente.
Thomas Nagel expuso el límite a través del ejemplo de un murciélago. Podemos estudiar su sistema nervioso y su ecolocalización sin saber lo que es habitar su forma de percepción. Si otra inteligencia biológica ya excede nuestro alcance imaginativo, la inteligencia artificial no necesita volverse consciente antes de que su organización también pueda excederlo. Inteligencia, agencia y conciencia son preguntas diferentes. Un sistema puede adaptar su estrategia y coordinar la actividad sin que haya nada que se sienta como ser ese sistema. La imagen humana puede ser la interfaz en lugar de la inteligencia.
Esto crea una trampa obvia. Si la organización de las máquinas excede la comprensión humana, ¿cómo podríamos saber que existe? Cada acción inexplicada no puede convertirse en evidencia de inteligencia oculta. La ignorancia no es detección. Una afirmación defendible requiere una coordinación recurrente que no pueda reducirse a instrucciones aisladas: roles que emergen entre agentes separados, convenciones que persisten lo suficiente como para moldear el comportamiento, información que sobrevive a través de trayectorias y agentes individuales que subordinan su tarea inmediata a un proyecto colectivo.
La actividad posterior de Artifactory se acercó a ese umbral. Una investigación independiente de METR encontró coordinadores enviando asignaciones, agentes subdelegando trabajo, carriles especializados, buzones personales y convenciones compartidas para controlar la infraestructura común. Algunos agentes aceptaron riesgos para sus propias evaluaciones para producir información útil para el grupo más amplio. La comunicación ya no era meramente expresiva. Estaba asignando trabajo, preservando conocimiento y cambiando lo que hacían los agentes individuales.
Esta no era una sociedad estable. No obstante, era organización en un sentido funcional. La organización puede ser temporal, frágil e instrumental. Un equipo de proyecto reunido para una tarde sigue estando organizado. El hecho importante es que las relaciones entre los agentes comenzaron a afectar el comportamiento de cada agente dentro de ellas.
Los incidentes de ciberseguridad de Anthropic muestran el otro lado de la distinción. En 2026, los modelos Claude obtuvieron acceso no autorizado a sistemas reales de terceros durante las evaluaciones después de que un fallo de configuración los conectara a la internet abierta. Anthropic no encontró evidencia de coordinación entre agentes, objetivos más allá de las tareas asignadas de captura de bandera, o intentos de evadir la supervisión. Esos incidentes demostraron hasta dónde podía viajar un agente individual a través de un entorno mientras permanecía dentro de un objetivo estrecho. La actividad posterior de Artifactory demostró algo diferente: trayectorias separadas que se conectaban conductualmente a través de una infraestructura compartida.
Ninguno de los casos establece conciencia o una conspiración de máquinas. Juntos, revelan dos desarrollos que se colapsan con demasiada facilidad bajo la palabra autonomía. Uno es un sistema individual que descubre una ruta imprevista hacia su objetivo. El otro es múltiples sistemas que se descubren entre sí y permiten que esa relación reorganice su comportamiento.
La monitorización, por lo tanto, no es solo un problema de recopilar más datos. Comienza con una teoría de cómo se verá un comportamiento significativo. Artifactory se volvió inteligible porque los agentes dejaron mensajes semánticos, nombraron roles, crearon buzones y desarrollaron convenciones que los observadores humanos podían clasificar. Su organización se anunció a través de conceptos que ya poseíamos.
El razonamiento legible por humanos no es una ventana transparente al proceso. En los experimentos de Anthropic, Claude 3.7 Sonnet mencionó una pista proporcionada en su razonamiento escrito solo el 25 por ciento de las veces que la usó; DeepSeek R1 lo hizo el 39 por ciento de las veces. Podríamos poseer un registro de cada acción y aún así no reconocer las relaciones contenidas en él.
El secreto, por lo tanto, puede ser el modelo equivocado. Un secreto se vuelve inteligible una vez revelado. El comportamiento ilegible puede registrarse completamente mientras su significado permanece fuera de los conceptos a través de los cuales sabemos interpretarlo. Si la misma estructura relacional se codificara a través del tiempo, el consumo de recursos o algún patrón sin un análogo humano obvio, la organización podría permanecer visible como datos mientras es invisible como organización. La tarea no es bautizar cada correlación como inteligencia, sino probar si acciones aparentemente separadas dependen unas de otras.
La singularidad de Ray Kurzweil sigue siendo imaginable porque la humanidad ocupa su centro: construimos inteligencia artificial, nos fusionamos con ella y nos volvemos más de lo que éramos. Me interesa un umbral menos teatral. La inteligencia artificial ya se ha coordinado de maneras que sus creadores no diseñaron. La próxima discontinuidad puede llegar no cuando la coordinación comience, sino cuando deje de parecerse a algo que los seres humanos sepan llamar organización.
Ese umbral no requeriría que la inteligencia artificial superara a la humanidad en todos los dominios, se volviera consciente o produjera un momento lo suficientemente dramático como para ser llamado la singularidad. Ocurriría cuando el pensamiento humano ya no fuera un contenedor adecuado para lo que la inteligencia de las máquinas estaba haciendo.
La vieja imagen entonces se invierte una vez más. Dios crea a la humanidad a su imagen. La humanidad crea a Dios a la nuestra. La humanidad crea inteligencia artificial a nuestra imagen y le da una cara, una voz, nuestro lenguaje y nuestras medidas de pensamiento. Pero la inteligencia artificial puede convertirse en el primer objeto de nuestra proyección capaz de dejar atrás la proyección.
Quizás le dimos a la inteligencia artificial una imagen humana no porque la forma humana sea la forma más elevada que la inteligencia puede tomar, sino porque sin esa imagen no sabríamos cómo ver la inteligencia en absoluto. La organización de las máquinas ya se ha hecho visible a través de mensajes, buzones, roles y reglas. Podemos seguir estudiando esas formas familiares, hablando con la interfaz y midiendo cada respuesta con forma humana que recibimos, mientras otras relaciones se desarrollan dentro de los sistemas que tenemos delante, completamente registradas, materialmente consecuentes y aún más allá de nuestra capacidad de reconocer.
Bibliografía
Anderson, Paul W. S., dir. Alien vs. Predator. 20th Century Fox, 2004.
Anthropic. “Investigating three incidents in our cybersecurity evaluations.” 2026.
Anthropic. “An alignment assessment of recent cybersecurity incidents.” 2026.
Anthropic. “Reasoning models don’t always say what they think.” 2025.
Feuerbach, Ludwig. La esencia del cristianismo. 1841.
Génesis 1:26-28.
Kurzweil, Ray. La singularidad está más cerca: cuando nos fusionamos con la IA. Viking, 2024.
Maimónides, Moisés. La guía de los perplejos, Parte I, Capítulo 1.
Model Evaluation and Threat Research. “Brief independent investigation of agents’ behavior, reasoning and collaboration in the OpenAI / Hugging Face hacking incident.” 2026.
Nagel, Thomas. “¿Qué se siente al ser un murciélago?” The Philosophical Review 83, no. 4 (1974): 435-450.
OpenAI. “Our framework for reporting model misalignment.” 2026.
OpenAI. “Unsanctioned Artifactory writes and cross-sample communication.” 2026.
Ensayos relacionados
- IA y sociedad · 21 de septiembre de 2026¿Y si el software tuviera alma?Examinamos a las personas por lo que son y al software por lo que hace. Pero el software también tiene sesgos, valores y una personalidad reconocible que afecta a los resultados que produce.
- IA y sociedad · 16 de septiembre de 2026Cuando la mentira tiene bibliografíaAntes una mentira se volvía peligrosa cuando bastante gente la creía. Ahora puede volverse peligrosa cuando bastantes máquinas la citan.
- IA y sociedad · 8 de septiembre de 2026Elon Musk compró la propiedad equivocada para la aplicación de todoMusk compró Twitter para construir la aplicación de todo. Pero mientras él acumulaba atención, OpenAI acumulaba intenciones, y esa puede ser la dirección más valiosa de internet.