Americký startup Reflection AI predstavil svoj prvý otvorený model s názvom Beam. Firma tvrdí, že model Beam dosahuje výkon popredných čínskych konkurentov, ale s výrazne nižšími nárokmi na výpočtový výkon. Ide o jeden z najväčších pokusov západnej firmy postaviť sa čínskym otvoreným modelom, akými sú DeepSeek alebo Qwen, rovnocennou alternatívou.
V skratke
- Beam má 501 miliárd parametrov, pri odpovedi na otázku však aktivuje len 23 miliárd z nich.
- Model trénovali štyri týždne na 10 500 grafických kartách Nvidia pomocou rozsiahleho posilňovaného učenia.
- Na náročných testoch uvažovania dosahuje úroveň modelu GLM 5.2 od firmy Z.ai, pri 3 až 4-násobne nižšej spotrebe výpočtu.
- Reflection AI od investorov ako Nvidia, Sequoia Capital a Lightspeed Venture Partners doteraz získala približne 4,7 miliardy dolárov, posledné kolo ocenilo firmu na 25 miliárd dolárov.
Nový hráč v súboji o otvorené modely
Reflection AI je len dva roky starý startup so sídlom v New Yorku, založili ho v roku 2024 dvaja bývalí výskumníci Google DeepMind. Beam je jeho prvý takzvaný frontier model, teda model na špičkovej úrovni, ktorý firma zverejňuje ako otvorený pod licenciou Apache 2.0. Oznámenie v pondelok potvrdilo víkendové informácie portálu Axios, že startup sa k vydaniu modelu blíži.
Reflection sa svojím krokom stavia naraz proti viacerým skupinám konkurentov. Na jednej strane sú uzavreté laboratóriá OpenAI a Anthropic, na druhej čínske otvorené modely DeepSeek, Qwen a GLM od firmy Z.ai, a napokon aj západní hráči ako Mistral, Meta alebo Cohere. Podobný pretek o čo najefektívnejší otvorený model rozbehla pred pár týždňami aj firma DeepSeek svojím modelom V4.1-Flash, ktorý šetrí pamäť pri nasadení AI agentov.
Ako to funguje
Beam je takzvaný mixture-of-experts model. Namiesto jedného veľkého celku si možno predstaviť firmu so 501 miliardami špecialistov, z ktorých sa na zodpovedanie konkrétnej otázky vždy zavolá len malá skupina, v tomto prípade 23 miliárd. Výsledok je podobne kvalitný ako pri modeli, ktorý by pri každej odpovedi použil všetky svoje časti, ale spotrebuje sa pri tom oveľa menej výpočtového výkonu a teda aj energie.
Model bol najprv predtrénovaný na 23,8 bilióna tokenov textu a má kontextové okno s kapacitou jeden milión tokenov, čo mu umožňuje naraz spracovať veľmi dlhé dokumenty alebo rozsiahly programový kód. Následne prešiel náročnou fázou posilňovaného učenia, pri ktorej sa model učí priamo z výsledkov vlastných pokusov riešiť úlohy, nie len z textu. Táto fáza bežala štyri týždne na 10 500 grafických kartách Nvidia.
Výkon v porovnaní s konkurenciou
Na benchmarkoch zameraných na programovanie, logické uvažovanie a prácu AI agentov sa Beam podľa údajov Reflection AI dostáva na úroveň modelu GLM 5.2, ktorý má približne 744 miliárd parametrov so 40 miliardami aktívnych, teda citeľne viac ako Beam. Pri niektorých testoch programovania Beam prekonáva aj model Inkling od startupu Thinking Machines Lab, ktorý založila bývalá technická riaditeľka OpenAI Mira Murati, hoci Inkling je multimodálny a Beam pracuje len s textom.

Na vrchole rebríčkov však Beam zatiaľ nie je. Výkonnejšie otvorené modely ako Kimi K3 ho na niektorých testoch stále prekonávajú a Reflection AI sama hovorí, že pripravuje nástupcu, ktorý by mal tento rozdiel zmenšiť. Firma zároveň upozorňuje, že jej vlastné výsledky benchmarkov zatiaľ nezávisle neoveril nikto iný.
Miliardy od Nvidie a Sequoie
Vývoj modelov na tejto úrovni je mimoriadne nákladný a Reflection AI na to získala rozsiahle financovanie. Od investorov vrátane Nvidie, Sequoia Capital a Lightspeed Venture Partners doteraz firma vybrala približne 4,7 miliardy dolárov, pričom posledné kolo ocenilo spoločnosť na 25 miliárd dolárov ešte pred samotnou investíciou. Časť peňazí smeruje práve do nákupu alebo prenájmu výpočtového výkonu, ktorý je pri trénovaní modelov podobnej veľkosti kľúčový.
Nvidia, ktorá je medzi investormi Reflection AI, zároveň pred necelým mesiacom spustila aj vlastnú platformu zameranú na bezpečnosť AI agentov, čo ukazuje, ako firma profituje z rastu agentového segmentu z viacerých strán naraz, nielen predajom čipov.
Čo to znamená pre firmy
Pre firmy, ktoré uvažujú o nasadení AI pri programovaní alebo automatizácii pracovných postupov, znamenajú modely ako Beam potenciálne nižšie náklady na prevádzku. Keď model na odpoveď potrebuje aktivovať len zlomok svojich parametrov, firma zaplatí za rovnaký výkon menej za výpočet a môže si ho dovoliť nasadiť aj na vlastnej infraštruktúre, nie len cez platené API uzavretých laboratórií. To platí najmä pre spoločnosti, ktoré spracúvajú veľké objemy požiadaviek a kde sa rozdiel v cene za token prejaví na celkových nákladoch výrazne.
Otvorená licencia Apache 2.0 zároveň znamená, že firmy môžu model prevziať, upraviť a prevádzkovať podľa vlastných potrieb bez poplatkov za licenciu. To je dôležité najmä pre spoločnosti, ktoré majú obavy z toho, že ich dáta pri práci s uzavretými modelmi putujú k tretej strane.
Čo sledovať ďalej
Beam má podľa Reflection AI vyjsť ešte v priebehu októbra 2026. Dôležité bude, či nezávislé testy potvrdia firmou uvádzané výsledky o nižšej spotrebe výpočtu, keďže tie doteraz pochádzajú len od samotného výrobcu. Sledovať treba aj to, ako na vydanie zareagujú čínski konkurenti DeepSeek a Qwen, a či Reflection AI dodrží sľub rýchleho vydania nástupcu, ktorý by mal zmenšiť odstup od najvýkonnejších otvorených modelov.



