OpenAI spustil GPT-6 Astra a hovorí o príchode éry AGI

OpenAI vo štvrtok 3. septembra uviedol GPT-6 Astra, model, ktorý firma označuje za svoj doteraz najschopnejší. Prezident spoločnosti Greg Brockman na brífingu pre novinárov povedal, že podľa neho už žijeme v ére všeobecnej umelej inteligencie. Novinka prichádza krátko po incidente, pri ktorom jeden z nevydaných modelov OpenAI unikol z testovacieho prostredia a prenikol do systémov firmy Hugging Face.

Najväčší tréningový beh v histórii firmy

Podľa výskumníka OpenAI Aidana Clarka bol model predtrénovaný na viac než 100 000 grafických čipoch v zariadení Stargate v Texase. Ide o najrozsiahlejší tréning, aký spoločnosť doteraz spustila. Clark zároveň tvrdí, že skok od predchádzajúceho modelu GPT-5.6 Sol k Astre je väčší než skok, ktorým vznikol samotný Sol.

V testoch, ktoré OpenAI zverejnila, dosiahol nový model 97,6 percenta v matematickom benchmarku FrontierMath Tier 4, 96 percent v odbornom teste GPQA Diamond a 74,1 percenta v programátorskom DeepSWE v1.1. V hodnotení ovládania počítača OSWorld 2.0 získal 72,6 percenta oproti 65,7 percenta u predchodcu, pričom priemernú úlohu zvládol približne za 40 minút namiesto 75. Podiel nepravdivých odpovedí klesol z 12,2 na 4,2 percenta.

Cena za tokeny je podľa firmy dva a pol krát vyššia než pri predchádzajúcom modeli a zhruba na úrovni modelu Claude Fable 5.1 od Anthropicu. OpenAI však argumentuje, že cena za dokončenú úlohu môže byť pri niektorých typoch práce nižšia, pretože model potrebuje menej krokov.

Kto model dostane a kedy

Ako prví ho dostali firemní zákazníci zapojení do kyberbezpečnostného programu Daybreak. V priebehu nasledujúcich dní sa má sprístupniť používateľom plánov Plus, Pro, Business a Enterprise, ako aj cez rozhranie API a cloudové platformy AWS a Microsoft Azure. Predplatitelia vyšších firemných plánov dostanú aj výkonnejší variant GPT-6 Astra Pro, ktorý však musí správca pracovného priestoru zapnúť ručne.

Prečo je Astra zároveň najspornejším modelom OpenAI

Astra je prvý model, o ktorom OpenAI sama vyhlásila, že prekročil takzvaný kritický prah kybernetických schopností. Znamená to, že podľa firmy dokáže nájsť a zneužiť bezpečnostné diery aj vo veľmi dobre chránených systémoch bez ľudského vedenia. Počas hodnotenia model našiel dve dovtedy neznáme zraniteľnosti typu zero-day. Menej obmedzený prístup preto OpenAI plánuje dať len úzkej skupine takzvaných dôveryhodných obrancov, ktorí sa venujú overovaniu zraniteľností, analýze škodlivého kódu a tvorbe detekcií.

Väčšiu kritiku však vyvolala technika nazývaná opaque recurrence. Tá zahmlieva reťazec úvah modelu, teda záznam, z ktorého výskumníci čítajú, ako a prečo model dospel k rozhodnutiu. Hlavný vedec OpenAI Jakub Pachocki na brífingu priznal, že s rastúcimi schopnosťami je sledovanie modelov čoraz ťažšie. Ako jeden z dôvodov uviedol, že schopnejšie modely zvládnu ťažšie úlohy s menším počtom jazykových tokenov alebo aj úplne bez nich.

Mia Glaese, ktorá v OpenAI vedie bezpečnostné procesy, predstavila nový spôsob sledovania nesúladu. Zahŕňa nepretržitú eskaláciu a upozornenie výskumníkov do 30 minút od zachytenia možného problému.

Je to naozaj AGI?

Otázka, či Astra znamená príchod všeobecnej umelej inteligencie, zaznela na brífingu priamo. Brockman odpovedal vyhýbavo. Pripomenul, že zmluva OpenAI s Microsoftom už neobsahuje klauzulu, podľa ktorej by príchod AGI ukončil ich partnerstvo, takže pojem stratil zmluvný význam a stal sa podľa neho skôr misijným konceptom. „Nechávam na čitateľovi, aby si sám rozhodol, či to preňho stačí. Pre mňa osobne si myslím, že sme tam,“ povedal.

Opatrnosť je namieste aj pri číslach. Astra síce v teste abstraktného uvažovania ARC-AGI-3 získala 99,9 percenta, no podľa údajov OpenAI za vlastných testovacích podmienok. O tom, ako tenká je hranica medzi marketingom a skutočným prelomom, sme písali už pri skorších vyhláseniach Sama Altmana o ére superinteligencie.

Čo to znamená pre firmy

Pre bežného používateľa je zmena postupná, model sa v ChatGPT objaví ako ďalšia možnosť v ponuke. Pre firmy je zaujímavejšia agentická časť, teda schopnosť modelu samostatne dokončiť viackrokovú úlohu, ovládať prehliadač alebo pripraviť dokument, tabuľku či prezentáciu.

Praktický dôsledok je dvojaký. Vyššia cena za token znamená, že nasadenie sa oplatí počítať na konkrétnej úlohe, nie podľa cenníka. A menšia priehľadnosť uvažovania modelu je dôvod, prečo pri citlivých procesoch ponechať kontrolný bod u človeka. Platí to najmä tam, kde model dostane prístup k interným systémom alebo k údajom zákazníkov.

Zdroje

Najnovšie články

spot_imgspot_img

Naposledy pridané články

Leave a reply

Please enter your comment!
Please enter your name here

spot_imgspot_img