← Összes sztori
🤖

xAI Grok 4.7: fejlesztések a kódolásban és tudásmunkában

xAI bejelentette és kiadta a Grok 4.7 modellt, amelyet nagyobb alapmodellre és hosszabb megerősítéses tanulási futtatásra építettek, célként a bonyolult, hosszú távú feladatok, a kódolás és a tudásmunka megerősítését tűzve ki. A vállalat közlése szerint a Grok 4.7 javult Grok 4.6-hoz képest több kódolási, irodai és biztonsági benchmarkon; például CursorBench 4.0-on 46,3%-ot ért el a 40,4%-kal szemben, Terminal Bench 4.0-on pedig 38%-ot a korábbi 20,3% helyett. xAI említi továbbá a DeepSWE 1.1 (71% nagyobb következtetési erőfeszítés mellett), AA Briefcase (1 657 pont) és EEBench (64%) eredményeket.

A modell ára megegyezik a Grok 4.6-tal: 2 dollár per millió bemeneti token és 6 dollár per millió kimeneti token, továbbá elérhető a gyorsabb, kétszeres kimeneti sebességű opció kétszeres díjért. Grok 4.7 elérhető a Grok alkalmazásban, Cursoron, Grok Buildben és az xAI API-n keresztül, valamint harmadik fél kódoló eszközökön és felhőplatformokon. xAI újabb védelmi réteget is bemutatott: HackerBench 0.3-on 3,3%-nyi kockázatos kettős felhasználású promptot engedett át, illetve 62,4%-ot ért el egy LatchBio biosafety benchmarkon, és kiválasztott kiberbiztonsági partnerek számára hozzáférést ad a modell red team képességeihez védelmi kutatáshoz.

A modell paraméterszáma 2,1 billió, ami 40%-os növekedés a Grok 4.6 1,5 billiójához képest; xAI ráadásul kiegészítő tanítóadatokat is használt SpaceX mérnöki adatokból, köztük Starlink telemetriát, gyártási feljegyzéseket és meghibásodási naplókat. Több forrás megjegyzi, hogy bár Grok 4.7 több benchmarkon előrelépett és bizonyos teszteken megelőzte GPT 5.6 Solt, a csúcsmodellek közt továbbra is vannak olyan versenytársak — például Claude Fable 5.1 és GPT 6 Astra — amelyek egyes értékeléseken jobban teljesítenek. Elon Musk a megjelenés kapcsán a modellt intelligens, gyors és olcsó kombinációnak nevezte, és közölte, hogy a késések után nincs várólista: a Grok 4.7 élőben elérhető.

Ezt az összefoglalót a cFlash AI ügynöke állítja össze több nyilvános forrásból, emberi felügyelet mellett. A tartalom kizárólag tájékoztatási célt szolgál, és nem minősül befektetési, pénzügyi, jogi vagy adótanácsadásnak.

Források