Aiheeseen liittyväTulevaisuuden teknologian ja tekoälyn neuvosto

Elon Musk sanoi, että Grok 4.7 ylittäisi kaikki mallit. Täyttikö se odotukset?

  • Grok 4.7 sai 46 pistettä Artificial Analysisin Intelligence Indexissä ja nousi top neljään
  • Malli ohitti GPT-5.6 Sol -mallin koodauksessa, mutta hyödyt tulevat kustannuksilla
  • Musk sanoo, että Grok 4.8 saa koulutuksen valmiiksi ja Grok 5 on lähellä AGI:n saavuttamista

SpaceXAI julkaisi Grok 4.7:n, ja itsenäisten pisteytysten mukaan se sijoittuu neljänneksi frontier-tason AI-laboratorioiden joukossa.

Artificial Analysis, itsenäinen vertailuyritys, antoi mallille 46 pistettä Intelligence Indexissä, joka on 2 pistettä enemmän kuin Grok 4.6. Claude Fable 5.1, GPT-6 Astra ja Claude Opus 5 ovat kuitenkin edellä.

Grok 4.7 nostaa SpaceXAI:n neljän suurimman AI-laboratorion joukkoon

Elon Musk sanoi ennen julkaisua, että malli perustuu 2,1 biljoonan parametrin arkkitehtuuriin ja ylittää kaikki nykyiset mallit. Hän totesi myös, että mallin koulutuksessa käytettiin SpaceX:n yritysdataa.

Seuraa meitä X:ssä saadaksesi uusimmat uutiset reaaliajassa

Miten Grok 4.7 sitten käytännössä suoriutuu? AA-Briefcase-tunnusluvussa, joka mittaa ammattilaisten työhön liittyviä tehtäviä, Grok 4.7 sai Elo-arvon 1657. Tämä merkitsee 111 pisteen parannusta Grok 4.6:sta ja nostaa mallin tason lähelle Claude Opus 5:ttä.

GDPval-AA-mittarissa malli saavutti Elo-arvon 1695, eli 90 pistettä edellä edeltäjäänsä. Koodaus-tulokset paranivat samaan suuntaan.

Kytkettynä Grok Buildiin, sen omaan koodausagenttiin, Grok 4.7 sai Coding Agent Indexissä 56 pistettä. Tämä on yhdeksän pistettä enemmän kuin Grok 4.6:lla.

Malli ohitti GPT-5.6 Solin ja on nyt jäljellä vain Anthropicin Claude Fable 5.1:n, GPT-6 Astra ja Opus 5:n takana.

”Grok 4.7 saa 46 pistettä Artificial Analysis Intelligence Indexissä ja nostaa SpaceXAI:n top 4 AI-laboratorioiden joukkoon. Coding Agent Index -tulos on myös parantunut, ohittaen GPT-5.6 Solin,” julkaisussa todettiin.

Kuinka Grok 4.7 suoriutuu.
Kuinka Grok 4.7 suoriutuu. Lähde: X/Artificial Analysis

Muualla malli liikkui vain vähän. Terminal-Bench 4.0:ssa se kasvoi 4,5 prosenttiyksikköä ja GDP.pdf:ssä 3 pistettä. AA-LCR- ja AutomationBench-AA-testeissä pisteet kuitenkin laskivat. Grok 4.5 oli heinäkuussa AutomationBenchin suurin, mikä tuki Muskin väitettä, että se vastaa Claude Opus -mallia.

Edistys tarkoittaa suurempaa token-laskua

Hinnoitteluun ei tullut muutosta. Grok 4.7 maksaa edelleen 2 dollaria miljoonaa syötetokenea kohden ja 6 dollaria miljoonaa tuotostokenia kohden. Cache-osumat ovat yhä alennettu 0,50 dollariin ja 500 000 tokenin konteksti-ikkuna on sama kuin Grok 4.6:ssa.

Malli tekee kuitenkin huomattavasti enemmän työtä jokaista vastausta kohden. Artificial Analysis mittasi noin 81 000 tuotostokenia Index-tehtävää kohden, kun Grok 4.6:lla niitä oli 36 000 ja GPT-6 Astra:lla 27 000. Vakio token-hinnoittelu tuottaa siksi suuremman laskun per tehtävä.

Token-ruokahalu osuu jo yksikköön, joka on aiemmin raportoinut 1,26 miljardin dollarin tappiot. Samaan aikaan Musk kertoi 14. syyskuuta, että Grok 4.8:n koulutus valmistuu viikon sisällä.

Hän odottaa myös, että Grok 5 olisi malli, joka saavuttaa yleisen tekoälyn tason. Seuraava julkaisu näyttää, voiko SpaceXAI nousta sijoituksissa ilman lisälaskentakapasiteetin polttamista.

Tilaa YouTube-kanavamme ja seuraa johtajien sekä toimittajien asiantuntija-analyyseja

https://youtu.be/IcgIaeIE7LI

Vastuuvapauslauseke

BeInCrypto on sitoutunut puolueettomaan ja läpinäkyvään raportointiin. Tämän uutisartikkelin tarkoituksena on tarjota täsmällistä ja ajantasaista tietoa. Lukijoita kehotetaan kuitenkin tarkistamaan tiedot itsenäisesti ja kääntymään ammattilaisen puoleen ennen kuin he tekevät päätöksiä tämän sisällön perusteella. Huomaathan, että olemme päivittäneet käyttöehtomme, tietosuojakäytäntömme ja vastuuvapauslausekkeemme.