Google predstavil Gemini 4 Argon, svoj nový frontier model zameraný najmä na komplexné, viacstupňové úlohy, programovanie, firemnú znalostnú prácu a kybernetickú bezpečnosť. A prvé výsledky vyzerajú veľmi dobre. (Zdroj: blog.google)
Podľa benchmarkov zverejnených Googlom dosiahol Argon najlepší výsledok v 13 z 19 porovnávaných testov proti GPT-6 Astra, Claude Fable 5.1 a Claude Opus 5.5. (Zdroj: Google DeepMind)
Samotné čísla sú zaujímavé. Ešte zaujímavejšie je však to, čo hovoria o dnešnom trhu s AI.
Model, ktorý patrí dnes medzi špičku, totiž nemusí byť najlepšou voľbou o niekoľko mesiacov.
Google sa opäť tlačí na čelo
Gemini 4 Argon dosahuje podľa Googlu veľmi dobré výsledky najmä pri znalostnej práci a dlhších komplexných úlohách.
V DeepSWE v1.1, ktorý testuje reálne dlhšie softvérové úlohy, dosiahol 77,9 %. V AutomationBench, zameranom na vykonávanie úloh naprieč bežnými firemnými funkciami, získal 51,3 % a obsadil prvé miesto. Pri LVBench, ktorý testuje porozumenie dlhému videu, dosiahol 91,7 %. (Zdroj: blog.google)
Google model vybavil aj kontextovým oknom s kapacitou 1 milión tokenov, čo mu umožňuje pracovať s veľmi rozsiahlym kontextom a viacstupňovými úlohami. To však ešte neznamená, že máme nového jednoznačného víťaza AI pretekov.
Benchmark nie je každodenná firemná práca
Výsledky porovnania pochádzajú od samotného Googlu a nezávislé hodnotenia zatiaľ ukazujú vyrovnanejší obraz.
Artificial Analysis napríklad zaradil Argon na rovnakú úroveň ako GPT-6 Astra, zatiaľ čo Claude Opus 5.5 zostáva v ich Intelligence Indexe vyššie. Objavili sa aj informácie o interných pochybnostiach v Googli týkajúcich sa výkonu modelu pri niektorých programovacích úlohách. (Zdroj: TNW)
Navyše si ho väčšina z nás zatiaľ ani nevyskúša.
Google sprístupňuje Argon postupne, pričom prvý prístup dostávajú vybrané tímy z oblasti kybernetickej bezpečnosti. Širšie nasadenie pre vývojárov, firmy a spotrebiteľov má nasledovať neskôr. (Zdroj: blog.google)
A práve toto všetko ukazuje niečo podstatnejšie.
AI trh už nemá jedného jasného víťaza
OpenAI, Google, Anthropic a ďalší poskytovatelia inovujú takým tempom, že náskok jednotlivých modelov môže byť veľmi krátky.
Jeden model môže byť výborný pri programovaní. Iný pri analýze rozsiahlych dokumentov. Ďalší môže byť vhodnejší pre konkrétny typ automatizácie, ponúknuť lepšiu cenu alebo vyhovovať požiadavkám firmy na spôsob nasadenia.
Pre firmu preto začína byť otázka:
„Ktorá AI je najlepšia?“
menej dôležitá než:
„Ktorá AI je najlepšia pre túto konkrétnu úlohu?“
Firma nepotrebuje najlepší model. Potrebuje fungujúce riešenie.
Ak chce firma automatizovať spracovanie objednávok, analyzovať dokumenty, vytvoriť interného asistenta alebo nasadiť AI agenta, samotný výber modelu je iba jednou časťou riešenia.
Dôležité je, ako AI zapadne do existujúceho procesu, s akými systémami komunikuje, aké dáta používa, čo môže vykonávať automaticky a kde zostáva rozhodnutie na človeku.
A tiež to, či firma dokáže technológiu neskôr zmeniť bez toho, aby musela celé riešenie postaviť nanovo.
Nestavajte firemnú AI okolo loga
Dnes môže byť pre konkrétnu úlohu najlepšou voľbou model od OpenAI. Pre inú Gemini, Claude alebo špecializovaný či lokálne prevádzkovaný model.
Preto dáva zmysel navrhovať firemné AI riešenia tak, aby neboli zbytočne závislé od jediného modelu alebo poskytovateľa.
Technológia pod kapotou sa môže meniť. Firemný problém, ktorý má riešenie vyriešiť, zostáva.
A možno práve toto je najzaujímavejšia správa z predstavenia Gemini 4 Argon.
Nie to, kto tento týždeň vyhral benchmark, ale fakt, že technologický náskok sa môže veľmi rýchlo meniť.
Pre firmy je preto dôležitejšie vedieť čo chcú pomocou AI vyriešiť, než uhádnuť, ktorá značka bude o rok na prvom mieste.

