Gemini 4 Argon: Google dobieha OpenAI aj Anthropic

Google 30. septembra 2026 spustil nový vlajkový jazykový model Gemini 4 Argon, prvý veľký model firmy po viac ako siedmich mesiacoch od Gemini 3.1 Pro. Model zatiaľ nie je verejne dostupný, Google ho najprv testuje len s vybranými partnermi v oblasti kybernetickej bezpečnosti. Podľa nezávislých meraní sa Gemini 4 Argon vyrovnal najlepším modelom od OpenAI a Anthropicu, jasného víťaza medzi nimi však určiť nemožno.

V skratke

  • Google spustil Gemini 4 Argon 30. septembra 2026, ide o prvý nový vlajkový model od Gemini 3.1 Pro spred vyše siedmich mesiacov, pôvodne ohlásený Gemini 3.5 Google úplne preskočil.
  • Model je zatiaľ dostupný len vybraným „dôveryhodným obrancom“ cez program Fairwind, zameraný na kybernetickú obranu, bežným používateľom a vývojárom sprístupní Argon postupne.
  • Nezávislý test Artificial Analysis dal Argonu 53 bodov v Intelligence Index, rovnako ako GPT-6 Astra a Claude Fable 5.1, Claude Opus 5.5 vedie s 58 bodmi.
  • Argon vygeneruje až milión výstupných tokenov naraz, čo Google označuje za prvenstvo v odvetví, a v úvodnej promo cene stojí 2 doláre za milión vstupných tokenov.

Čo je Gemini 4 Argon a prečo prichádza práve teraz

Pre Google ide o dôležitý návrat do čela pretekov vo veľkých jazykových modeloch. Spoločnosť naposledy predstavila frontierový model s Gemini 3.1 Pro, odvtedy uplynulo vyše sedem mesiacov, počas ktorých Google podľa portálu The Decoder potichu zrušil pôvodne ohlásený model Gemini 3.5. Konkurencia medzitým nezaháľala, OpenAI vydalo model Astra a Anthropic model s krycím menom Fable, oba firmy prezentovali ako svoje doteraz najschopnejšie systémy. Argon má Google opäť zaradiť medzi tri najsilnejšie laboratóriá, hoci podľa dostupných meraní si Anthropic zatiaľ udržuje mierny náskok.

Meno Argon nie je náhodné, Google model najprv sprístupnil len vybranej skupine takzvaných dôveryhodných obrancov v rámci programu Fairwind, teda bezpečnostnej iniciatívy zameranej na kybernetickú obranu. Model bol podľa Googlu trénovaný špecificky na defenzívnu prácu v kybernetickej bezpečnosti a dokáže podľa firmy samostatne nájsť, overiť a opraviť kritické chyby v softvéri. Google tiež tvrdí, že jeho vlastní zamestnanci už Argon bežne používajú pri písaní kódu, ladení chýb a migráciách kódovej základne. Model je súčasťou aj dobrovoľného programu americkej vlády, ktorý vybraným úradom umožňuje otestovať nové modely ešte pred verejným vydaním.

Ako Argon funguje vysvetlené pre laika

Pri veľkých jazykových modeloch sa bežne hovorí o kontextovom okne, teda o tom, koľko textu model naraz vidí na vstupe, a o výstupných tokenoch, čo je množstvo textu, ktoré dokáže v jednej odpovedi vygenerovať. Argon si ponechal vstupné kontextové okno na milióne tokenov, no výstupný limit zdvihol z doterajších 64-tisíc na celý milión tokenov, čo Google označuje za prvenstvo v odvetví. Prakticky to znamená, že model dokáže riešiť zložitý problém krok po kroku v jedinom súvislom zamyslení bez toho, aby musel odpoveď predčasne ukončiť.

Aby to fungovalo aj technicky, Google do svojho rozhrania pridal funkciu s názvom Long Decode Continuation, ktorá dlhé odpovede priebežne pozastavuje a cez nadväzujúce požiadavky ich dokončuje, takže sa generovanie nezastaví na časovom limite. Argon navyše spracuje okrem textu aj obrázky, video a zvuk, výstup však zatiaľ poskytuje len v texte. Práve schopnosť analyzovať dlhé videá alebo grafy je podľa Googlu jedna z jeho silných stránok popri kóde a bezpečnostnej práci.

Výkon v porovnaní s konkurenciou

Nezávislé meranie Artificial Analysis Intelligence Index ukazuje vyrovnanejší obraz, než aký si Google maľuje vo vlastnom blogu. V najvyššom režime uvažovania „High“ dosiahol Argon 53 bodov, rovnako ako GPT-6 Astra v režime max a Anthropicov model Claude Fable 5.1, a o bod viac než GPT-6.1 Sol v režime max. Anthropic si napriek tomu drží vedenie, model Claude Opus 5.5 dosiahol 58 bodov a Claude Sonnet 5.5 56 bodov. Oproti predchádzajúcemu modelu Gemini 3.1 Pro Preview ide u Argonu o skok o 23 bodov, čo je najväčšie medzigeneračné zlepšenie spomedzi porovnávaných firiem.

Abstraktná vizualizácia porovnania výkonu AI modelov v benchmarkoch pomocou grafov

Pri agentových úlohách, teda keď model sám vykonáva viackrokové akcie namiesto jednej odpovede, si Argon polepšil výraznejšie. V teste AutomationBench-AA je s výsledkom 77,5 percenta na prvom mieste, šesť bodov pred Claude Sonnet 5.5 v režime max. V teste Terminal Bench 4 dosiahol 57 percent, čo je oproti predchodcovi skok o 53 bodov, no stále zaostáva za Claude Sonnet 5.5 s 64 percentami, Claude Opus 5.5 s 60 percentami aj GPT-6 Astra s 59 percentami. Zaujímavý je aj výsledok testu AA-Omniscience, ktorý meria mieru halucinácií, teda ako často si model vymýšľa fakty namiesto priznania, že odpoveď nepozná. Argon tu skončil na 15 percentách, výrazne lepšie než GPT-6 Astra v režime max s 51 percentami a GPT-6.1 Sol v režime max s 54 percentami.

Google vo vlastnom blogu tvrdí, že Argon prekonal GPT-6 Astra aj Anthropicove modely Fable a Opus naprieč viacerými benchmarkmi, a odvoláva sa pritom na rebríček benchmarkovacieho startupu Vals, kde má byť aktuálne na prvom mieste. Nezávislé meranie Artificial Analysis však ukazuje opatrnejší obraz, bez jasného víťaza.

Cena a dostupnosť

Google zatiaľ Argon sprístupňuje len postupne. Prvú vlnu tvoria vybraní „dôveryhodní obrancovia“ z programu Fairwind a interné tímy Googlu, ktorí dostávajú model bez bezpečnostných obmedzení pre kybernetickú prácu. Spätná väzba od tejto skupiny má podľa Googlu pomôcť doladiť bezpečnostné mechanizmy skôr, než sa Argon otvorí vývojárom, firmám a bežným používateľom, najprv platiacim zákazníkom API a predplatiteľom Google AI Ultra. Presný dátum plošného spustenia Google neuviedol.

Cena je už známa. V úvodnej promo sadzbe stojí milión vstupných tokenov 2 doláre a milión výstupných 10 dolárov, po skončení akcie cena stúpne na 4, respektíve 20 dolárov. Tokeny z vyrovnávacej pamäte sú o 95 percent lacnejšie, teda zhruba 10 centov za milión v promo období. Jedna úloha v Intelligence Index tak v akcii vyjde na 1,99 dolára, čo je 60 percent ceny GPT-6 Astra za rovnakú úlohu, no 2,7-násobok ceny lacnejšieho GPT-6.1 Sol. Po skončení akcie cena stúpne na 3,98 dolára, teda zhruba o pätinu viac než GPT-6 Astra. Nižšia cena pritom nie je dôsledkom efektivity, Argon na jednu úlohu minie v priemere 62-tisíc výstupných tokenov, zatiaľ čo GPT-6 Astra len 27-tisíc.

Čo to znamená pre firmy

Pre firmy, ktoré si vyberajú medzi veľkými jazykovými modelmi, pribúda ďalšia reálna alternatíva k OpenAI a Anthropicu, hoci zatiaľ len vo veľmi obmedzenom prístupe. Rozhodovanie sa oplatí robiť podľa konkrétnej úlohy, nie podľa marketingových vyhlásení výrobcu. Argon vyniká v agentových scenároch a má nízku mieru halucinácií, čo je výhoda pri úlohách, kde si firma nemôže dovoliť vymyslené fakty, napríklad pri analýze zmlúv alebo zákazníckej podpore. Naopak v surovej cene za vyriešenú úlohu zatiaľ nie je jednoznačne najlacnejší, pretože na dosiahnutie výsledku potrebuje viac tokenov než konkurencia. Firmy by preto mali pred nasadením porovnať nielen cenník, ale aj to, koľko tokenov model na typickú úlohu reálne spotrebuje, podobne ako to bolo dôležité aj pri predchádzajúcom hlasovom modeli Gemini 3.8 Live.

V najbližších týždňoch bude kľúčové, ako rýchlo Google rozšíri prístup z úzkej skupiny testerov na platiacich zákazníkov a bežných používateľov Gemini. Rovnako dôležité bude sledovať, či nezávislé testy po plnom spustení potvrdia benchmarkové výsledky z uzavretého testovania, a ako na Argon zareagujú OpenAI a Anthropic, ktorých modely v agentových úlohách zatiaľ stále vedú.

Zdroje

Redakcia AIportal.sk
Redakcia AIportal.skhttps://www.aiportal.sk/o-nas/
Redakcia AIportal.sk denne sleduje dianie okolo umelej inteligencie vo svete, na Slovensku a v Česku a vyberá z neho správy, ktoré majú význam pre firmy a bežných ľudí. Každý článok vychádza z aspoň dvoch overených zdrojov, ktoré sú uvedené na jeho konci.

Najnovšie články

spot_imgspot_img

Naposledy pridané články

Leave a reply

Please enter your comment!
Please enter your name here

spot_imgspot_img