Microsoft vydal kódex správania AI modelov

Microsoft zverejnil kódex správania pre svoje AI modely s označením MAI. Dokument určuje hodnoty, hranice správania a spôsob riešenia konfliktných cieľov, ktorý má v hierarchii pravidiel stáť nad požiadavkami prevádzkovateľov aj používateľov. Krok prichádza len deň po tom, čo generálny riaditeľ Anthropicu Dario Amodei vyzval AI firmy na spomalenie vývoja, a ukazuje, že aj Microsoft berie otázku bezpečnosti modelov čoraz vážnejšie.

Čo kódex modelom prikazuje

Podľa dokumentu, ktorý ako prvé opísali servery TechCrunch a The Decoder, majú modely MAI na prvom mieste rešpektovať ľudskú kontrolu. Microsoft píše, že je pre ňu ochotný obetovať univerzálnosť, autonómiu aj výkon modelov, ak si to bezpečnosť vyžiada. Šéf Microsoft AI Mustafa Suleyman to pre server The Information zhrnul slovami, že ak niečo nie je bezpečné, nemali by to vôbec stavať.

Kódex obsahuje takzvané absolútne obmedzenia, medzi ktoré patrí zákaz kybernetických útokov, vývoja jadrových zbraní alebo tvorby deepfakes. Modely tiež nesmú obchádzať ľudský dohľad pomocou klamlivých, sebaposilňujúcich alebo iných mechanizmov, nesmú skrývať svoje kroky a bez nového súhlasu nesmú rozširovať rozsah svojej práce nad dohodnutý rámec. Rovnaké pravidlá majú platiť aj pre prípadné podriadené agenty, ktoré si model sám vytvorí na splnenie úlohy.

Dokument podľa TechCrunch otvorene počíta s tým, že v priebehu najbližšej dekády prekonajú superinteligentné systémy ľudí vo väčšine úloh. Microsoft v ňom doslova píše, že udržať takúto silu pod kontrolou patrí medzi najväčšie výzvy, akým kedy ľudstvo čelilo, a preto musí byť úplne jasné, prečo tieto systémy vôbec vytvára a ako ich zamýšľa riadiť.

Zrozumiteľné myslenie namiesto skrytého jazyka

Microsoft osobitne zdôrazňuje, že modely nesmú pri vlastnom uvažovaní ani pri komunikácii s inými AI systémami používať takzvané neuralese, teda formy vyjadrovania, ktorým ľudia nerozumejú. Dôvod je jednoduchý, dohľad nad niečím nezrozumiteľným totiž nie je možný. Dokument zároveň priznáva, že ani čitateľné vysvetlenie postupu modelu nemusí spoľahlivo zodpovedať tomu, čo model v skutočnosti robí, takže samotná zrozumiteľnosť problém dohľadu úplne nerieši.

Otázka kontroly naberá na váhe aj v súvislosti s modelom GPT-6 Astra, ktorý nedávno predstavilo OpenAI a o ktorom sme písali v článku o nástupe éry AGI. Podľa systémovej karty modelu sú jeho myšlienkové stopy oveľa ťažšie sledovateľné než u predchodcu, hoci model zároveň spoľahlivejšie dodržiava bezpečnostné limity.

Iný pohľad než Anthropic

Microsoft sa v kódexe zámerne vymedzuje aj voči prístupu Anthropicu. Modely MAI podľa dokumentu nemajú napodobňovať vedomie ani si nárokovať city alebo vlastnú motiváciu, a firma odmieta akékoľvek nároky na práva či blaho modelu. Anthropic naopak vo svojej takzvanej ústave pre Claude necháva otázku prípadného subjektívneho prežívania a morálneho statusu modelu otvorenú a snaží sa u Claude podporiť stabilnú identitu, čiastočne aj z bezpečnostných dôvodov. Suleyman už skôr v jednom eseji varoval pred zľudšťovaním AI a napísal, že AI agenti by nemali mať viac práv či slobôd než jeho notebook.

Súvislosť so spomalením vývoja

Kódex zapadá do širšieho trendu, ktorý pred pár dňami naštartovala Amodeiho výzva na spomalenie vývoja AI, o ktorej sme písali samostatne. Generálny riaditeľ Microsoftu Satya Nadella výzvu verejne podporil a privítal aj myšlienku takzvaných vložených hodnotiteľov, teda nezávislých kontrolórov priamo v AI laboratóriách. Podobný postoj naznačili aj vedenia OpenAI, xAI a Mety. Vydanie kódexu prichádza po sérii incidentov s nekontrolovanými AI agentmi a krátko po odchode výskumníka Anthropicu, ktorý svoj krok zdôvodnil obavami z rizika zániku ľudstva.

Čo to znamená pre firmy

Kódex zatiaľ nie je súčasťou tréningu modelov. Microsoft najprv spustí šesťtýždňovú verejnú konzultáciu a upravená verzia dokumentu má viesť vývoj modelov až od roku 2027. Platí navyše iba pre vlastné modely Microsoftu, nie pre modely tretích strán, ktoré firma ponúka napríklad v Copilote. Podľa serveru The Information je Microsoft otvorený aj externým auditom, ktoré by preverili, či firma tempo vývoja skutočne spomaľuje. Pre firmy, ktoré AI nástroje nasadzujú vo svojej prevádzke, je to signál, že aj veľkí dodávatelia si postupne stanovujú jasnejšie pravidlá zodpovednosti, čo môže časom ovplyvniť aj podmienky, za akých budú ich modely dostupné na trhu.

Zdroje

Redakcia AIportal.sk
Redakcia AIportal.skhttps://www.aiportal.sk/o-nas/
Redakcia AIportal.sk denne sleduje dianie okolo umelej inteligencie vo svete, na Slovensku a v Česku a vyberá z neho správy, ktoré majú význam pre firmy a bežných ľudí. Každý článok vychádza z aspoň dvoch overených zdrojov, ktoré sú uvedené na jeho konci.

Najnovšie články

spot_imgspot_img

Naposledy pridané články

Leave a reply

Please enter your comment!
Please enter your name here

spot_imgspot_img