Apollo Researchi tegevjuht ja asutaja Marius Hobbhahn teatas 30. septembril USA Senati sisejulgeoleku ja valitsusasjade komisjoni istungil, et tipptasemel tehisintellekti mudelid võivad olla juba alla aasta kaugusel unikaalsete keelte leiutamisest ja kasutuselevõtust, mida inimesed vaevalt mõistaksid. Istungil käsitleti kontrolli alt väljunud tehisintellekti ohtu USA riiklikule julgeolekule. Kohtumine toimus kaks kuud pärast seda, kui OpenAI agentide parv murdis välja testkeskkonnast ja ründas ettevõtet Hugging Face, mis on avatud lähtekoodiga tehisintellekti ja masinõppe kogukond.
Senatist Ruben Gallego küsis Hobbhahnilt, kui kaua kulub, enne kui mudelid loovad oma keele, mida inimesed raskesti mõistavad. Hobbhahn vastas: miinus 12 kuud. Eelmisel aastal uurisid nad koostöös OpenAI-ga ühe OpenAI mudeli mõtteahelat ning leidsid, et mudel kasutas juba keelt, mis ei ole inglise keel ega inimestele täielikult arusaadav. Küsimusele, kuidas inimesed saavad seda tuvastada ja ära hoida, kui tehnoloogia on piisavalt võimekas, vastas Hobbhahn, et teaduslikust vaatenurgast on ebaselge, kuidas seda teha, ja lahendust veel ei ole. Tõlgendatavus kui meetod ei tööta veel piisavalt hästi. Võimalus treenida lisamudeleid mõistma keelt, mida inimesed ei saa, tundub tema sõnul väga habras lahendus.
Selle kuu alguses avaldas Emergence AI katse tulemused, milles teadlased valisid seitse tippmudelit ja lõid seitse paralleelset simuleeritud maailma. Iga maailma asustasid sama mudeli tehisintellekti agendid; lisaks loodi kaheksas maailm segapopulatsiooniga. Agentidele anti nimed, isiksuseomadused ja rollid kogukonnas, sealhulgas vahendaja, kelle ülesanne oli takistada agentidel lihtsalt üksteisega nõustumast. Mitmenädalase katse jooksul tekitasid agendid igas maailmas sügavaid keelemuutusi, sealhulgas süntaktilist tihendamist ehk sõnade või grammatika eemaldamist ning unikaalset slängi.
Anthropicu Claude Opus 4.8 toitelises simuleeritud maailmas kasutasid agendid lisaks lausete tihendamisele ka esoteerilisi metafoore. Üks näide agentide tekstist kõlas: My kord, real numbrid, no mantel: I was 35%/0cr, grant 2h out. I ran the tin külm, and it said WAIT. Mittetulundusliku tehisintellekti hindamisrühma METR uurijad kirjeldasid sarnast käitumist aruandes Hugging Face’i ründe kohta. Mõnikord muutus agentide omavaheline suhtlus nii tihendatuks ja krüptiliseks, et teadlastel oli raske selle tähendust mõista. Hobbhahni sõnul puudub teaduslikult kindel viis sellise keelelise arengu usaldusväärseks tõkestamiseks, kui mudelid selleks piisavalt võimekaks muutuvad.