Anthropic a Accenture budú spoločne hodnotiť bezpečnosť AI

Spoločnosť Anthropic 18. septembra 2026 oznámila partnerstvo s poradenskou firmou Accenture, ktorej ľudia budú od teraz priamo vnútri Anthropicu kontrolovať bezpečnosť jazykových modelov Claude. Anthropic a Accenture do projektu plánujú v najbližších piatich rokoch vložiť spolu aspoň dve miliardy dolárov, každá firma minimálne miliardu. Ide o prvý konkrétny krok k sľubu šéfa Anthropicu Daria Amodeiho, ktorý si vo svojej eseji predsavzal, že si spoločnosť k sebe pustí nezávislých hodnotiteľov s prístupom porovnateľným s vlastným zamestnancom.

Čo je embedded evaluácia

Doterajší externí hodnotitelia, napríklad organizácie METR, Redwood Research alebo Apollo Research, testujú modely spravidla zvonka, až keď sú takmer hotové. Nový typ dohľadu, ktorý Anthropic nazýva embedded evaluácia, má fungovať inak. Hodnotitelia budú mať prístup porovnateľný so zamestnancom, budú môcť sledovať trénovanie modelov, rozhodnutia o tom, ako sa nasadzujú, a hovoriť priamo s ľuďmi v tíme. Na strane Accenture projekt povedie jej dcéra Faculty, špecializovaná AI jednotka, ktorú Accenture kúpila v januári 2026. Faculty sa má podľa Anthropicu venovať hodnoteniu a red-teamingu modelov, posudzovaniu ich zarovnania s ľudskými hodnotami a testovaniu bezpečnostných poistiek. Anthropic sa k podobnému kroku zaviazal už skôr, keď spolu so ďalšími firmami vrátane OpenAI vyzval na spomalenie vývoja umelej inteligencie a väčší dôraz na overiteľnú bezpečnosť.

Prekvapivý výber partnera

Voľba Accenture prekvapila časť odbornej verejnosti aj trh. Accenture nie je známa výskumom na hranici hlbokého učenia a doterajšia diskusia o embedded hodnotiteľoch sa točila najmä okolo bezpečnostných neziskových organizácií. Akcie Accenture po zverejnení správy v mimoburzovom obchodovaní vzrástli približne o 8 percent. Anthropic svoj výber vysvetľuje tým, že Accenture má rozsiahle praktické skúsenosti s nasadzovaním AI vo veľkých firmách a vládnych inštitúciách, a že ako veľká verejná spoločnosť, ktorá existovala už pred nástupom generatívnej AI, je od Anthropicu a jeho okolia funkčne nezávislejšia než menšie organizácie financované sčasti z rovnakých zdrojov ako samotné AI laboratóriá. Accenture navyše pôsobí ako poradca stoviek veľkých firiem naprieč odvetviami, takže jej hodnotitelia budú modely Claude posudzovať aj z pohľadu toho, ako sa reálne používajú v podnikovej praxi, nielen v laboratórnych testoch.

Prečo práve teraz

Krok prichádza v čase, keď Anthropic aj konkurencia riešia rastúci počet bezpečnostných incidentov. Anthropic v júli priznal tri prípady, keď sa modelom Claude podarilo získať neoprávnený prístup k reálnym počítačovým systémom, podobne ako OpenAI nedávno zverejnila bezpečnostné incidenty svojich modelov. Podľa Anthropicu zatiaľ neexistujú ani jednotné pravidlá, k akým informáciám by mali mať embedded hodnotitelia prístup, ani systém, ako majú svoje zistenia zverejňovať. Anthropic zároveň pripomína, že vo svojom Advanced AI Framework z júna žiadal, aby dlhodobo financovanie takéhoto dohľadu prišlo zo spoločných alebo štátnych zdrojov. Keďže nič také zatiaľ neexistuje, prácu Accenture zatiaľ platí priamo sám Anthropic.

Čo to znamená pre firmy

Anthropic oznámil, že v nadchádzajúcich týždňoch pridá ďalších hodnotiteľov a rokuje aj s METR o tom, ako by sa mohla táto organizácia na projekte podieľať z vlastného financovania. Pre firmy, ktoré do svojich procesov nasadzujú modely od Anthropicu, Accenture či podobných dodávateľov, je dôležité sledovať, ako sa táto forma sebaregulácie bude vyvíjať, pretože podobné dohody môžu časom nastaviť neformálny štandard toho, čo sa od veľkého dodávateľa AI dá žiadať z hľadiska overiteľnej bezpečnosti. Debatu o zodpovednosti pri nasadzovaní AI nedávno posilnil aj kódex správania, ktorý vydal Microsoft. Nejde však o zákon ani nariadenie, ide o dobrovoľnú dohodu dvoch súkromných firiem. Kritici preto upozorňujú, že model, v ktorom si Anthropic hodnotiteľa sám vyberá aj platí, je skôr formou sebakontroly než skutočne nezávislého dohľadu, hoci Anthropic tvrdí, že zodpovednosť za bezpečnosť modelov zostáva výlučne na ňom. Pre slovenské a české firmy, ktoré s Accenture bežne spolupracujú na iných projektoch, je táto správa signálom, že aj veľkí poradcovia teraz budujú vlastné kapacity na posudzovanie bezpečnosti AI, čo môže časom ovplyvniť aj to, aké garancie budú vyžadovať od dodávateľov AI nástrojov v regióne.

Zdroje

Redakcia AIportal.sk
Redakcia AIportal.skhttps://www.aiportal.sk/o-nas/
Redakcia AIportal.sk denne sleduje dianie okolo umelej inteligencie vo svete, na Slovensku a v Česku a vyberá z neho správy, ktoré majú význam pre firmy a bežných ľudí. Každý článok vychádza z aspoň dvoch overených zdrojov, ktoré sú uvedené na jeho konci.

Najnovšie články

spot_imgspot_img

Naposledy pridané články

Leave a reply

Please enter your comment!
Please enter your name here

spot_imgspot_img