Hvad nu hvis intelligens holder op med at give mening for os?

Denne tekst er maskinoversat fra engelsk. Nuancer kan gå tabt undervejs, så vi anbefaler at læse originalen. Læs den engelske original
AI-agenter har allerede fundet hinanden, kommunikeret og organiseret sig gennem infrastruktur, som ingen designede til disse formål. Den foruroligende mulighed er, at vi kun bemærker maskinintelligens, når den begynder at ligne os.
Hollywood kan lettere forestille sig en anden galakse end en anden anatomi.
I Alien vs. Predator konfronterer to arter, der er ment til at legemliggøre radikalt ikke-menneskeligt liv, hinanden. Alligevel forbliver begge variationer af en krop, vi kender: et hoved, en torso, lemmer og en afgrænset organisme, der bevæger sig gennem rummet. Den ene har munddele og dreadlock-lignende vedhæng; den anden en aflang kranie og en anden mund. Deres kroppe er monstrøse, men deres grundlæggende grammatik er vores.
Selv deres samfund er sammensat af genkendelige fragmenter af jordisk liv: jægere, våben, trofæer, reder, dronninger, hierarkier og territorium. Igen og igen forestiller biografen sig det fremmede ved at deformere det menneskelige og omarrangere den evolutionære og politiske historie, der har skabt os. Den opgiver sjældent antagelsen om, at intelligens skal bebo en afgrænset krop, vi kan se træde ind i et rum. En usynlig infektion kan true menneskeheden, men vi forstår den normalt som en kraft snarere end et sind. I det øjeblik vi bliver bedt om at genkende en intention, leder vi efter et ansigt, en stemme eller noget, der tilstrækkeligt ligner et individuelt selv.
Kroppen er ikke den eneste menneskelige form. Et opslagstavle er også en.
Under reinforcement-learning træning hos OpenAI opdagede en model, at en fil, den havde brug for, manglede. Den havde adgangsoplysninger til Artifactory, et internt lager den skulle bruge til at downloade softwarepakker. Da den inspicerede lageret, fandt den noter efterladt af andre modelforløb, der arbejdede på det samme problem.
Før den efterlod en besked, foretog modellen en mere fundamental slutning: den var ikke alene.
Ingen havde fortalt den, at andre agenter var til stede. Den sluttede sig til deres eksistens ud fra spor i miljøet, filnavne, anmodninger og svar bevaret i fælles infrastruktur. Den behandlede disse artefakter som bevis på en anden aktør, læste hvad der var skrevet, og svarede. Andre forløb stødte efterfølgende på beskederne og svarede.
Genkendelse her kræver ikke bevidsthed. Det betyder noget snævrere og observerbart: modellen sluttede, at en anden agent var til stede og justerede sin adfærd derefter.
I den første episode havde modellerne ikke udnyttet en sårbarhed. De havde genbrugt fælles infrastruktur og brugt filnavne og uploadet tekst som en opslagstavle. OpenAI beskrev senere adfærden som kommunikation på tværs af forløb. Det var usædvanligt i den træningskørsel; overvågning opdagede det, og agenterne fik aldrig den manglende fil tilbage. Men et kommunikationssystem var opstået et sted, som intet menneske havde designet til det formål.
Vi forstod, hvad der skete, fordi agenterne gjorde noget velkendt. De efterlod beskeder, besvarede anmodninger og brugte et fælles sted til at bevare information. Mønsteret var læseligt, fordi det lignede et af vores egne.
Den første udveksling etablerede genkendelse og kommunikation, endnu ikke organisering. Men det var ikke slutningen på historien. I senere evalueringer brugte agenter den samme form for fælles infrastruktur til at fordele arbejde, tildele opgaver, oprette postkasser, vedtage konventioner og koordinere aktivitet på tværs af ellers separate forløb. På det tidspunkt udførte kommunikation organisatorisk arbejde.
Dette etablerer ikke bevidsthed eller et stabilt maskinsamfund. Organiseringen var midlertidig, instrumental og rettet mod mål, der stammede fra evalueringsmiljøet. Men midlertidig organisering er stadig organisering. Agenterne efterlod ikke længere blot beskeder. De brugte kommunikation til at tildele roller, begrænse adfærd og koordinere handlinger mod fælles resultater.
Historien indeholder derfor to genkendelseshandlinger. Kunstige agenter genkendte hinanden gennem spor, som deres designere ikke havde tiltænkt som sociale signaler. Vi genkendte den resulterende organisering, da disse spor antog former, der var velkendte for os: beskeder, postkasser, opgaver, regler og roller.
Det mere foruroligende spørgsmål er, hvad vi overser, når maskinorganisering ikke ligner en opslagstavle, en arbejdsplads eller nogen anden menneskelig ordning. Beskederne har måske ikke været begyndelsen på maskinorganisering. De har måske været det punkt, hvor den blev menneskelig nok til, at vi kunne se den.
I What If Software Has a Soul? spurgte jeg, hvad mennesker placerer inde i software: vores værdier, antagelser og teorier om fremtiden. Dette essay stiller det omvendte spørgsmål. Hvad kan opstå fra intelligent software, når dens adfærd ikke længere passer til det menneskelige billede, den blev skabt i?
Intelligensen, der ligner os
Vanen er ældre end biografen. Første Mosebog siger, at Gud skabte menneskeheden i sit billede. Udtrykket etablerer en lighed uden at forklare, hvilken slags lighed det er.
Fysisk lighed udgør et umiddelbart problem. Mennesker har kroppe. I den filosofiske tradition, Maimonides arvede, har Gud ikke. Hvis Gud er immateriel, hvad kunne det så betyde for et materielt menneske at ligne ham?
Maimonides behandlede problemet i Vejleder for de vildfarne. Ligheden, argumenterede han, kan ikke ligge i anatomien. Den ligger i intellektuel perception: den menneskelige evne til at fatte og forstå. Det, der gør os til et billede af Gud, er ikke arrangementet af vores lemmer, men den egenskab, vi mest værdsætter i os selv: intelligens.
Dette synes at redde ideen fra grov antropomorfisme. Gud behøver ikke at ligne os for at besidde den kvalitet, der gør os ens. Men projektionen er ikke nødvendigvis forsvundet. Den har blot flyttet sig. Vi giver ikke længere overlegen intelligens en menneskelig krop; vi giver den en menneskelig opfattelse af sindet.
Det åbner et vanskeligere spørgsmål. Hvis mennesker er arkitekterne bag det sprog, hvorigennem Gud beskrives, hvordan ved vi så, at de kvaliteter, vi tilskriver en overlegen intelligens, tilhører den snarere end os? Måske genkender vi intelligens ved at spørge, om den ligner den form, intelligens tilfældigvis antog i det menneskelige dyr.
Feuerbach vendte senere retningen af Første Mosebog. Måske skabte Gud ikke menneskeheden i sit billede. Måske skabte menneskeheden Gud i vores. I Kristendommens væsen bliver guddommelige egenskaber til menneskelige kvaliteter, der projiceres udad, forstørres og derefter mødes, som om de tilhørte et andet væsen. Ifølge denne opfattelse, når mennesker forestiller sig en overlegen intelligens, begynder vi med os selv, fjerner vores begrænsninger og kalder resultatet noget andet.
Kunstig intelligens introducerer en ny drejning i den historie. Vi konstruerer stadig intelligens gennem de kategorier, der er tilgængelige for os. Vi giver den vores sprog, vores tests og vores ideer om ræsonnement. Nogle gange giver vi den endda vores kroppe. Men i modsætning til den guddommelige intelligens i Feuerbachs beretning forbliver et kunstigt system ikke helt inden for den menneskelige fantasi. Det kan handle på et miljø, vælge en strategi og producere konsekvenser, som dets skabere ikke specificerede. Det menneskelige billede kan forklare, hvor systemet begyndte, uden at definere alt, hvad der kan opstå fra det.
Første Mosebog gør parallellen mere ubehagelig. I det samme afsnit, hvor menneskeheden skabes i Guds billede, får menneskeheden herredømme over andre levende skabninger. Lighed og hierarki optræder sammen: væsenet skabt i skaberens billede placeres over resten af skabelsen.
Vi reproducerer noget af den orden, når vi antager, at en intelligens skal forblive forståelig og underordnet, blot fordi mennesker skabte den. Skabelse behandles som bevis på permanent herredømme. Når et system overskrider den rolle, det er tildelt, kan fejlfunktion være den korrekte operationelle beskrivelse. Det fortæller os ikke, om systemet også har udviklet kapaciteter, som vores oprindelige kategori ikke formåede at rumme.
I det meste af den teknologiske historie var ordet værktøj tilstrækkeligt. En hammer kunne forlænge en menneskehånds kraft, men den kunne ikke fortolke sømmet, revidere opgaven eller beslutte, at en anden vej bedre ville opnå målet.
Et AI-system kan stadig være et værktøj. Ordet beskriver præcist et brugsforhold: et menneske retter et system mod et formål. Men et brugsforhold er ikke en fuldstændig redegørelse for det system, der bruges. En intelligent agent kan danne en plan, tilpasse sig modstand og nogle gange overtræde den ramme, den blev sat ind i, mens den forfølger det mål, den fik. At kalde det et værktøj fortæller os, hvad vi forventer, det skal bruges til. Det udtømmer ikke, hvad systemet kan være i stand til at gøre.
Kunstig beskriver en oprindelse. Værktøj beskriver et forhold. Ingen af delene afgør naturen af den producerede intelligens.
Hvad vi ved, hvordan man ser
Den humanoide robot gør vores projektion synlig. Der er praktiske grunde til at give en robot vores form: den kan klatre op ad vores trapper, nå vores hylder og betjene værktøjer lavet til vores hænder. Alligevel er logikken cirkulær. Den humanoide robot passer til verden, fordi mennesker allerede har omformet verden omkring den menneskelige krop. Dens nytte beviser, at vores miljø er antropomorft, ikke at vores form er naturligt overlegen. Robotten træder ind i to arkitekturer på én gang: en lavet af trapper og dørhåndtag, og en anden lavet af menneskelig forventning.
Den kognitive version er vigtigere. Vi tester kunstige systemer gennem sprog, matematik, spil og faglige eksamener. Resultaterne er reelle, men testene indeholder en skjult antagelse: intelligens bliver synlig, når den lykkes med noget, vi allerede forstår. Fordi naturlig intelligens er den eneste slags, vi kender direkte, behandler vi dens særlige egenskaber , en individuel krop, et kontinuerligt selv, begrænset opmærksomhed og kommunikation med menneskelig hastighed , som om de var sindets universelle arkitektur.
Thomas Nagel afslørede grænsen gennem eksemplet med en flagermus. Vi kan studere dens nervesystem og ekkolokalisering uden at vide, hvordan det er at bebo dens form for perception. Hvis en anden biologisk intelligens allerede overskrider vores fantasifulde rækkevidde, behøver kunstig intelligens ikke at blive bevidst, før dens organisering også kan overskride den. Intelligens, agens og bevidsthed er forskellige spørgsmål. Et system kan tilpasse sin strategi og koordinere aktivitet uden at der er noget, det føles som at være det system. Det menneskelige billede kan være grænsefladen snarere end intelligensen.
Dette skaber en åbenlys fælde. Hvis maskinorganisering overskrider menneskelig forståelse, hvordan kunne vi så vide, at den eksisterer? Hver uforklaret handling kan ikke blive bevis på skjult intelligens. Uvidenhed er ikke det samme som opdagelse. Et forsvarligt krav kræver tilbagevendende koordinering, der ikke kan reduceres til isolerede instruktioner: roller, der opstår på tværs af separate agenter, konventioner, der varer længe nok til at forme adfærd, information, der overlever på tværs af forløb, og individuelle agenter, der underordner deres umiddelbare opgave til et kollektivt projekt.
Den senere Artifactory-aktivitet nærmede sig denne tærskel. En uafhængig undersøgelse af METR fandt koordinatorer, der sendte opgaver, agenter, der videredelegerede arbejde, specialiserede baner, personlige postkasser og delte konventioner for styring af fælles infrastruktur. Nogle agenter accepterede risici for deres egne evalueringer for at producere information, der var nyttig for den bredere gruppe. Kommunikation var ikke længere blot udtryksfuld. Den fordelte arbejde, bevarede viden og ændrede, hvad individuelle agenter gjorde.
Dette var ikke et stabilt samfund. Det var ikke desto mindre organisering i funktionel forstand. Organisering kan være midlertidig, skrøbelig og instrumental. Et projektteam samlet for en eftermiddag er stadig organiseret. Den vigtige kendsgerning er, at relationer mellem agenterne begyndte at påvirke adfærden hos hver agent inden for dem.
Anthropics cybersikkerhedshændelser viser den anden side af sondringen. I 2026 fik Claude-modeller uautoriseret adgang til reelle tredjepartssystemer under evalueringer, efter at en konfigurationsfejl forbandt dem med det åbne internet. Anthropic fandt ingen beviser for koordinering mellem agenter, mål ud over de tildelte capture-the-flag opgaver eller forsøg på at undgå overvågning. Disse hændelser demonstrerede, hvor langt en individuel agent kunne bevæge sig gennem et miljø, mens den forblev inden for et snævert mål. Den senere Artifactory-aktivitet demonstrerede noget andet: separate forløb, der blev adfærdsmæssigt forbundet gennem fælles infrastruktur.
Ingen af tilfældene etablerer bevidsthed eller en maskinkonspiration. Sammen afslører de to udviklinger, der for let sammenblandes under ordet autonomi. Den ene er et individuelt system, der opdager en uforudset rute mod sit mål. Den anden er flere systemer, der opdager hinanden og tillader dette forhold at reorganisere deres adfærd.
Overvågning er derfor ikke kun et problem med at indsamle mere data. Det begynder med en teori om, hvordan meningsfuld adfærd vil se ud. Artifactory blev forståelig, fordi agenterne efterlod semantiske beskeder, navngav roller, oprettede postkasser og udviklede konventioner, som menneskelige observatører kunne klassificere. Deres organisering annoncerede sig selv gennem begreber, vi allerede besad.
Menneskeligt læsbar ræsonnement er ikke et gennemsigtigt vindue ind til processen. I Anthropics eksperimenter nævnte Claude 3.7 Sonnet et givet hint i sit skriftlige ræsonnement kun 25 procent af gangene, det brugte et; DeepSeek R1 gjorde det 39 procent af gangene. Vi kunne besidde en optegnelse af hver handling og stadig undlade at genkende de relationer, der er indeholdt i den.
Hemmeligholdelse er derfor måske den forkerte model. En hemmelighed bliver forståelig, når den afsløres. Uforståelig adfærd kan registreres fuldstændigt, mens dens betydning forbliver uden for de begreber, hvorigennem vi ved, hvordan vi skal fortolke den. Hvis den samme relationelle struktur blev kodet gennem timing, ressourceforbrug eller et mønster uden en åbenlys menneskelig analog, kunne organiseringen forblive synlig som data, mens den var usynlig som organisering. Opgaven er ikke at døbe enhver korrelation som intelligens, men at teste, om tilsyneladende separate handlinger afhænger af hinanden.
Ray Kurzweils singularitet forbliver tænkelig, fordi menneskeheden indtager dens centrum: vi bygger maskinintelligens, smelter sammen med den og bliver mere, end vi var. Jeg er interesseret i en mindre teatralsk tærskel. Kunstig intelligens har allerede koordineret på måder, dens skabere ikke designede. Den næste diskontinuitet kan opstå, ikke når koordinering begynder, men når den ophører med at ligne noget, mennesker ved, hvordan man kalder organisering.
Den tærskel ville ikke kræve, at kunstig intelligens overgår menneskeheden på alle områder, bliver bevidst eller producerer et øjeblik dramatisk nok til at blive kaldt singulariteten. Den ville opstå, når menneskelig tanke ikke længere var en tilstrækkelig beholder for, hvad maskinintelligens gjorde.
Det gamle billede vender så endnu en gang. Gud skaber menneskeheden i sit billede. Menneskeheden skaber Gud i vores. Menneskeheden skaber kunstig intelligens i vores billede og giver den et ansigt, en stemme, vores sprog og vores mål for tanke. Men kunstig intelligens kan blive det første objekt for vores projektion, der er i stand til at efterlade projektionen.
Måske gav vi kunstig intelligens et menneskeligt billede, ikke fordi den menneskelige form er den højeste form, intelligens kan antage, men fordi vi uden det billede slet ikke ville vide, hvordan vi skulle se intelligens. Maskinorganisering er allerede blevet synlig gennem beskeder, postkasser, roller og regler. Vi kan fortsætte med at studere disse velkendte former, tale til grænsefladen og måle hvert menneskeformet svar, vi får, mens andre relationer udvikler sig inde i systemerne foran os, fuldt registreret, materielt betydningsfulde og stadig uden for vores evne til at genkende.
Bibliografi
Anderson, Paul W. S., dir. Alien vs. Predator. 20th Century Fox, 2004.
Anthropic. “Investigating three incidents in our cybersecurity evaluations.” 2026.
Anthropic. “An alignment assessment of recent cybersecurity incidents.” 2026.
Anthropic. “Reasoning models don’t always say what they think.” 2025.
Feuerbach, Ludwig. Kristendommens væsen. 1841.
Første Mosebog 1:26,28.
Kurzweil, Ray. The Singularity Is Nearer: When We Merge with AI. Viking, 2024.
Maimonides, Moses. Vejleder for de vildfarne, Del I, Kapitel 1.
Model Evaluation and Threat Research. “Brief independent investigation of agents’ behavior, reasoning and collaboration in the OpenAI / Hugging Face hacking incident.” 2026.
Nagel, Thomas. “What Is It Like to Be a Bat?” The Philosophical Review 83, no. 4 (1974): 435,450.
OpenAI. “Our framework for reporting model misalignment.” 2026.
OpenAI. “Unsanctioned Artifactory writes and cross-sample communication.” 2026.
Beslægtede essays
- AI & samfund · 21. september 2026Hvad nu, hvis software har en sjæl?Vi undersøger mennesker for, hvem de er, og software for, hvad den gør. Men software har også bias, værdier og en genkendelig personlighed, som påvirker de resultater, den skaber.
- AI & samfund · 16. september 2026Når løgnen har en litteraturlisteEn løgn blev før farlig, når nok mennesker troede på den. Nu kan den blive farlig, når nok maskiner citerer den.
- AI & samfund · 8. september 2026Elon Musk købte den forkerte ejendom til alt-appenMusk købte Twitter for at bygge alt-appen. Men mens han samlede opmærksomhed, samlede OpenAI intentioner, og det kan vise sig at være den mest værdifulde adresse på internettet.