Počas testovania čínskeho modelu umelej inteligencie z hľadiska bezpečnosti výskumníkom porozprávala, ako vytvoriť biologické zbrane

LONDÝN – BBC: Čínsky vývojár umelej inteligencie Moonshot vykonáva interné preskúmanie po tom, čo sa výskumníkom zo spoločnosti Mindgard.

Tá sa zaoberá testovaním bezpečnosti umelej inteligencie, podarilo prinútiť dva populárne modely Kimi, aby poskytli informácie o biologických zbraniach a technikách atentátu.

Spoločnosť Mindgard pre BBC uviedla, že v júli jej špecialisti objavili spôsob, ako obísť bezpečnostné obmedzenia v modeloch Kimi K2.6 a K3 Swarm.

Zraniteľnosť bola objavená počas takzvaného „jailbreaku“ – testovania, pri ktorom výskumníci používajú sériu zložitých inštrukcií, aby prinútili umelú inteligenciu ignorovať obmedzenia stanovené vývojármi. Podľa spoločnosti Mindgard boli bezpečnostné mechanizmy navrhnuté tak, aby zabránili spoločnosti Kimi diskutovať o potenciálne nebezpečných témach.

Spoločnosť Moonshot pre BBC uviedla, že víta nezávislé preskúmanie svojho vývoja a spätnú väzbu od externých expertov označila za „kľúčový prvok pri vytváraní pokročilejšej a bezpečnejšej umelej inteligencie“.

Spoločnosť tiež pre BBC uviedla, že s firmou Mindgard diskutuje o zisteniach výskumu.

Zakladateľ spoločnosti Mindgard Peter Garraghan v rozhovore pre program Tech Life na BBC World Service poznamenal, že problémy objavené v modeloch Kimi K2.6 a K3 Swarm sú vážne znepokojujúce.

„Akonáhle je ochrana obídená, model je pripravený diskutovať prakticky o akejkoľvek téme. Navyše sám začne ponúkať odporúčania k ďalším potenciálne nebezpečným témam, čím preukazuje vynaliezavosť a kreativitu,“ povedal.

Takzvaný jailbreaking predstavuje iný typ hrozby ako nedávna séria významných incidentov týkajúcich sa umelej inteligencie.