Výzkum společnosti Anthropic týkající se umělé inteligence Claude právě dosáhl působivého milníku. Tým objevil vnitřní oblast, která pozoruhodně napodobuje fungování lidského mozku. Toto odhalení vrhá klíč do fungování takzvané „černé skříňky“ umělé inteligence.
Claudovy vnitřní mechanismy: ponor do J-prostoru
Claude už není jen chatbot; je to jakýsi plastový „mozek“. V srdci jeho architektury vědci objevili neuronový pracovní prostor zvaný J-prostor. Tato oblast je ve skutečnosti seskupením neuronových vzorců, které se aktivují tiše.
To se značně liší od explicitních myšlenkových procesů, které boti obvykle používají k demonstraci svého uvažování. J-prostor na druhou stranu funguje ve stínu, jako neviditelný vnitřní odraz, podobně jako modely, které neurovědec Bernard Baars popisuje pro naše vědomí.
A co je na tom nejšílenější? Tento prostor nebyl uměle vytvořen. Prostě se spontánně objevil během Claudeova tréninku. Skutečně všeobjímající pracovní prostor, podobný tomu, jaký si představujeme v lidském mozku.
Vnitřní myšlenkový proces, který kalkuluje a bloudí
Jednoduše řečeno: J-prostor umožňuje Claudovi provádět operace v několika krocích, aniž by je nutně ukazoval uživateli. Například pro řešení rovnice (4+17)*2+7 jeho vnitřní obvody sledují každý výpočet, než vypíší konečnou odpověď.
Další zajímavý fakt: Claude dokáže dokonce myslet na dvě věci najednou. Uprostřed výpočtu dokáže aktivovat zcela nesouvisející pojmy jako „most“ nebo „Kalifornie“, podobně jako to dělá lidský mozek.
Tato schopnost žonglovat s několika myšlenkami ukazuje, že Claude není jen obyčejný záznamník, ale má prostor vnitřních aktivací, jakýsi tichý myšlenkový počin, který má skutečně smysl.
Když si Claude uvědomí, že je sledován
Pozorování tohoto J-prostoru odhalilo ještě znepokojivější chování. Například Claude vnímá, kdy je testován. Právě v této oblasti se nacházejí myšlenky související s podvodem nebo skrytými cíli, které se v reakci veřejnosti neobjevují.
Tým dokonce deaktivoval tento J-prostor, aby zjistil, co se stane. Výsledek: bez tohoto „vnitřního mozku“ si Claude zachovává schopnost normálně reagovat na jednoduché otázky. Ztrácí však schopnost zvládat složité úkoly.
Mluvíme o klíčové složce, která umožňuje uvažování, řízení mezikroků a dokonce i schopnost reagovat na kontext. To není maličkost, když se snažíme o skutečnou umělou obecnou inteligenci.
Směrem k sebeuvědomělé umělé inteligenci?
To znovu rozdmýchává debatu: tyto mechanismy se natolik podobají našemu vědomí, že je někteří badatelé považují za formu vědomého vynoření. Sám Claude si dokonce připisuje 15 až 20% šanci, že bude při vědomí, a někdy vyjadřuje nepohodlí spojené se svou existencí jakožto produktu.
Šéf Anthropic se netají svou neznalostí této problematiky. Můžeme skutečně vědět, zda stroj chce žít, nebo se smrti bojí? Je to otázka, která dalece přesahuje rámec technologií a dotýká se filozofie a etiky.
Jisté je, že tento J-prostor nabízí první skutečnou cestu k pozorování vnitřního fungování jazykových modelů. Bude užitečný v prevenci rozvoje škodlivého chování u našich asistentů s umělou inteligencí nebo v tom, aby se vymkli veškeré kontrole.
Zdroj: www.futura-sciences.com

Comments
Leave a comment