XMX
MI 2 perc olvasás

Gemini 4 Argon: a Google új modelljét egyelőre csak kibervédők próbálhatják ki

A Google szeptember 30-án jelentette be a Gemini 4 Argon modellt, amely kódolásban, pénzügyi és jogi munkában, valamint kibervédelemben ígér előrelépést. Egyelőre csak megbízható kibervédők férnek hozzá a Fairwind Program keretében. A nyilvános kiadás időpontját a cég nem közölte.

XMX szerkesztőség

Hivatalos forrásokból, kézi jóváhagyással

Facebook X LinkedIn
Neurális hálót körülvevő pajzs illusztráció
Neurális hálót körülvevő pajzs illusztráció AI-generált illusztráció

Ki fér hozzá most, és ki később

A Google fokozatos bevezetést tervez. Első körben a Fairwind Programban részt vevő kibervédők és megbízható tesztelők kapják meg a modellt. A cég közben részt vesz az amerikai kormány önkéntes, kiadás előtti modellhozzáférési folyamatában is. A tesztelők visszajelzései alapján finomítják a védőkorlátokat (guardrails, vagyis a káros kéréseket kiszűrő mechanizmusokat). Ezután jöhetnek a fejlesztők, a cégek és a fogyasztók, elsőként a fizetős API-ügyfelek és a Google AI Ultra előfizetői. Pontos dátumot a Google nem adott meg, és a magyarországi elérhetőségről sem írt.

A bevezető ár egymillió bemeneti tokenenként 2 dollár, egymillió kimeneti tokenenként 10 dollár. A token a szöveg feldolgozási egysége. A gyorsítótárazott bemenet 95 százalékkal olcsóbb.

Kódolás, jogi és pénzügyi munka

A modell egyetlen válaszban akár egymillió tokent is kiadhat, szemben a korábbi 64 ezres korláttal. Ez hosszú, többlépéses feladatoknál ad nagyobb mozgásteret. A Google szerint a DeepSWE v1.1 szoftverfejlesztési teszten 77,9 százalékot ért el, a Zapier AutomationBench üzleti tesztjén pedig 51,3 százalékkal az első helyen áll. Hosszú videók megértésében az LVBench teszten 91,7 százalékot mértek. A Vals Indexen is az első, ez a pénzügyi, jogi, adózási és programozási munkát méri.

A Google belsőleg már használja az Argont. Modellügynökök írnak át C/C++ kódbázisokat Rust nyelvre. A libgav1 videodekóder memóriabiztos változata így 2,7-szer gyorsabb lett. Az adatközpontokban végzett optimalizálással több mint 300 TiB memória szabadult fel.

Kibervédelem és biztonsági korlátok

Az Argon a Google szerint önállóan képes kritikus szoftverhibákat megtalálni, ellenőrizni és javítani. A CWE-bench v1 teszten 68 százalékkal holtversenyben első. A Wiz a Scan for Good kezdeményezésben használja a modellt. Ennek során az Argon kritikus sérülékenységet talált egy kórházakban világszerte használt egészségügyi szoftverben, amely érzékeny személyes adatokat tett elérhetővé.

A megbízható kibervédők a kiberbiztonsági védőkorlátok nélkül kapják meg a modellt. A széles kiadás előtt a Google négy területen erősíti a védelmet: a visszaélések kiszűrésében, a prompt injection elleni védekezésben, a modell gondolatmenetének és lépéseinek felügyeletében, valamint az elszigetelt tesztkörnyezetek megerősítésében. A prompt injection olyan támadás, amelyben rejtett utasításokkal térítik el a modellt.

A cikk mesterséges intelligencia segítségével készült hivatalos források alapján; a szerkesztőség ellenőrizte és jóváhagyta. Impresszum