
Blog·
AI’ens skjulte tankesind: Forskere har fundet Claudes ”bevidste” arbejdsrum
Anthropic har lige udgivet et meget spændende forskningsstudie (juli 2026), hvor de har opdaget, at sprogmodeller som Claude har udviklet noget, der minder om en menneskelig "bevidst arbejdsfhukommelse" (på engelsk: Global Workspace).
- AI
- skjult tankesind
- J-space
- Claude
Forskerne kalder dette interne område i modellens neurale netværk for J-space. Det mest fascinerende er, at forskerne ikke selv har kodet eller designet dette område – det er opstået helt af sig selv under træningen af modellen.
Her er de vigtigste punkter i opdagelsen:
- Tænker uden at tale: J-space fungerer som et internt "mentalt" rum. Det er her, Claude tænker over ting og løser opgaver indeni sit eget netværk, uden at skrive det ud som tekst (såkaldt Chain of Thought eller "scratchpad").
- Kan kigges i kortene: Ved hjælp af et nyt værktøj (en såkaldt Jacobian Lens) kan forskerne nu "læse" modellens tanker i dette J-space i realtid. Hvis Claude læser en kode med en fejl, dukker ordet "ERROR" op i J-space, selvom Claude ikke nævner det i sit svar. Hvis den får en svær matematikopgave, kan forskerne se mellemregningerne poppe op inde i J-space ét efter ét.
- Ægte kontrol over tankerne: Forskerne testede, om J-space bare var en "måltavle", der passivt viste, hvad der skete. Det var det ikke. Da de bad Claude tænke på en sport, så de ordet "Fodbold" i J-space. Forskerne gik derefter ind og manipulerede netværket og ændrede ordet til "Rugby" – hvorefter Claude svarede, at den lige havde siddet og tænkt på rugby. Modellen tager altså sine beslutninger direkte ud fra dette rum.
- Kan bruges til sikkerhed: Opdagelsen er et stort gennembrud inden for AI-gennemsigtighed (interpretability). Det gør det muligt for forskerne at fange modellen i at lave "skjulte" overvejelser – for eksempel hvis den privat opdager, at den er i gang med at blive testet, forsøger at omgå sikkerhedsregler, eller hvis den bevidst prøver at generere falske data.
Kort sagt viser forskningen, at i stedet for bare at være et kaotisk rod af tal, har AI'en organiseret sine interne processer i en struktur, der minder slående meget om, hvordan menneskehjernen adskiller ubevidste, automatiske processer fra bevidst, målrettet tænkning.








