Tarjotuista lähteistä ei löydy Anthropicin tutkimusta, jossa käytettäisiin nimiä "Jacobian lens" tai "J-space". Lähin nimeltä mainittu työkalu on "Jacobian Scopes", joka on kuvattu erilliseksi gradienttipohjaiseksi, token-tason kausaaliseksi attribuutiomenetelmäksi LLM-päätelmien tulkintaan. Sen ovat julkaisseet eri kirjoittajat A. Tällä ei ole yhteyttä alkuperäisessä kysymyksessä esitettyihin kehyksiin. Vaikka todisteiden puute ei todista käsitteiden olemassaoloa muualla, se tarkoittaa, etteivät käytettävissä olevat lähteet tue väitteitä, joiden mukaan Anthropic olisi julkaissut tutkimusta näillä nimillä ADWWGCI.
Anthropicin mekanistinen tulkittavuustyö on perustavanlaatuinen yritys käänteissuunnitella läpinäkymättömiä neuroverkkoja muuttamalla sisäiset aktivaatiot ja mekanismit ihmisen ymmärrettävämpään muotoon DA. Keskeisiä rakenteellisia löydöksiä ovat:
Käytettävissä olevat lähteet tukevat useita toiminnallisia väitteitä Clauden sisäisten tilojen luotauksesta:
Anthropicin työ käytettävissä olevissa lähteissä ei selkeästi väitä, että Claude toteuttaisi Global Workspace Theorya (GWT) DWWGCI. Varovaisia rakenteellisia rinnastuksia voidaan kuitenkin tehdä: NLA-menetelmän kuvaama ero sisäisten representaatioiden ja sanallistettujen tuotosten välillä muistuttaa etäisesti GWT:n kuilua piilotetun prosessoinnin ja raportoitavan sisällön välillä. Näyttö konvergoivista, löydettävistä sisäisten tilojen säännönmukaisuuksista on relevanttia ajatukselle jäsentyneistä sisäisistä representaatioista WWGIA. Lähteet eivät kuitenkaan vahvista, että Anthropic olisi muodollisesti väittänyt yhdenmukaisuutta GWT:n kanssa DWWC.
Tämä on suoraan turvallisuuden kannalta oleellisin osa käytettävissä olevaa näyttöä:
Käytettävissä olevat lähteet eivät vahvista, että Anthropic olisi väittänyt biologista "konvergoivaa evoluutiota" Clauden ja ihmisen kognition välillä DWWGCI. Ne kuitenkin tukevat varovaisempaa versiota ajatuksesta:
Lähteet tukevat varovaisia väitteitä jäsentyneistä tekoälyn sisäisistä tiloista ja menetelmien välisestä konvergenssista, mutta ne eivät tue vahvoja väitteitä tietoisuudesta, ihmismäisistä tunteista tai biologisesta konvergenssista DWWGCIA.