A SpaceXAI szerint a Grok 4.5 legyőzi a GPT 5.5-öt ott, ahol a fejlesztőknek a leginkább számít

enlightened Ez az oldal a közösségért készül. heart Kövess minket máshol is:  Linux Mint Magyar Közösség a Mastodon-on  Telegram csatorna – csak hírek  Beszélgessünk a Telegram – Linux csevegő csoport  Hírek olvasása RSS segítségével  Linux Mint Hivatalos Magyar Közösség a Facebook-on      Linux Mint Baráti Kör a Facebook-on
wink Ha hasznosnak találod, és szeretnéd, hogy folytatódjon, támogasd a munkát Ko-fi vagy Paypal segítségével. laugh

kami911 képe

A MI-iparágban alig jut idő levegőt venni a nagy bejelentések között. A SpaceXAI a legújabb szereplő, amely lépett: bemutatta a Grok 4.5-öt, és azt állítja, hogy az új modell felülmúlja a riválisokat azokban a feladatokban, amelyek a fejlesztőknek a leginkább számítanak – például kódkészítésben és összetett problémák megoldásában.

A cég szerint a Grok 4.5 hatalmas adathalmazokon tanult, amelyek a szoftverfejlesztés, a tudomány, a mérnöki tervezés és a matematika területeit fedik le. A fejlesztés során szorosan együtt dolgoztak a népszerű Cursor AI kódszerkesztővel, kifejezetten azért, hogy a fejlesztők gyorsabban írjanak szoftvert, könnyebben javítsák a hibákat, és hatékonyabban birkózzanak meg a komolyabb technikai feladatokkal.

Természetesen egyetlen MI-kiadás sem teljes benchmark grafikonok nélkül. A SpaceXAI azt mondja, a Grok 4.5 66,1 százalékos eredményt ért el a DeepSWE benchmarkon, ezzel hajszállal megelőzve a GPT 5.5 xhigh modellt, amely 64,31 százalékot kapott. A számok jól mutatnak, de az ilyen tesztek ritkán adják vissza a teljes képet. A fejlesztőknek általában sokkal fontosabb, hogy egy MI tényleg időt spórol-e a valódi projekteken, mint az, hogy hogyan szerepel gondosan összeválogatott feladatokon.

A SpaceXAI azt is állítja, hogy a Grok 4.5 hatékonyabban működik a versenytársaknál: szoftvermérnöki feladatoknál nagyjából feleannyi tokent használ, miközben akár másodpercenként 80 token sebességgel válaszol. Ha ezek az állítások a látványos demókon kívül is megállják a helyüket, a gyorsabb válaszidő és az alacsonyabb tokenhasználat együtt valódi költségcsökkenést hozhat azoknak a cégeknek, amelyek az API-t használják.

A cég olyan demókat mutatott be, ahol a Grok 4.5 egyetlen promptból teljes webalkalmazásokat épít, összetett Excel-munkafüzeteket készít webes kutatással és több munkalapon átívelő képletekkel, PowerPoint-prezentációkat tervez natív alakzatokkal, illetve gondosan megszerkesztett Word-dokumentumokat ír. A bemutatók látványosak, de a rajt körüli demók általában a legjobb eseteket mutatják.

Az árképzésben is igyekszik kitűnni a SpaceXAI. A Grok 4.5 ára 2 dollár millió input tokenre és 6 dollár millió output tokenre. A cég szerint a modell nagyjából kétszer olyan tokenhatékony, mint az összehasonlítható riválisok, ami tovább csökkentheti a teljes költséget.

A Grok 4.5 már elérhető a Grok Buildben, a Cursorban és a SpaceXAI API-n keresztül. A SpaceXAI korlátozott ideig ingyenes hozzáférést is ad a Grok Build és a Cursor felületén. Az egyetlen igazán jelentős korlát, hogy a modell még nem érhető el az Európai Unióban, bár a cég szerint a régióban is hamarosan, még ebben a hónapban megjelenik.

Erős MI-modellekből mostanra nincs hiány. Az OpenAI, az Anthropic, a Google és most a SpaceXAI is azért versenyez, hogy a fejlesztők őket válasszák az egyre többre képes modellekkel. Hogy a Grok 4.5 valóban beváltja-e a SpaceXAI ígéreteit, akkor derül ki igazán, amikor a fejlesztők nem benchmarkokon, hanem éles projekteken kezdik el nyúzni.