Correlato a questo argomentoConsiglio Tecnologia del Futuro e IA

Elon Musk ha detto che Grok 4.7 avrebbe superato ogni modello, ha mantenuto la promessa?

  • Grok 4.7 ha ottenuto un punteggio di 46 sull’Intelligence Index di Artificial Analysis, entrando così nella top quattro.
  • Il modello ha superato GPT-5.6 Sol nelle prestazioni di coding, ma i guadagni comportano un costo.
  • Musk afferma che Grok 4.8 terminerà il training e che Grok 5 sarà vicino a raggiungere l’AGI.
Promo

SpaceXAI ha rilasciato Grok 4.7 e valutazioni indipendenti lo posizionano al quarto posto tra i principali laboratori di intelligenza artificiale.

Artificial Analysis, una società indipendente di benchmarking, ha assegnato al modello un punteggio di 46 sul suo Intelligence Index, 2 punti in più rispetto a Grok 4.6. Claude Fable 5.1, GPT-6 Astra e Claude Opus 5 ottengono però punteggi ancora superiori.

Grok 4.7 spinge SpaceXAI nella top quattro dei laboratori di AI

Elon Musk aveva dichiarato prima del lancio che il modello sarebbe stato basato su 2,1 trilioni di parametri e avrebbe superato tutti i modelli attuali. Ha aggiunto che l’addestramento del modello ha incluso anche dati aziendali di SpaceX.

Seguici su X per ricevere le ultime notizie in tempo reale

Contenuto sponsorizzato
Contenuto sponsorizzato

Ma come si comporta davvero Grok 4.7? Su AA-Briefcase, un benchmark ideato da Artificial Analysis per valutare compiti professionali realistici, Grok 4.7 ha ottenuto un punteggio Elo di 1.657. Si tratta di un balzo di 111 punti rispetto a Grok 4.6, portando il livello del modello vicino a quello di Claude Opus 5.

Su GDPval-AA, il modello ha raggiunto un Elo di 1.695, ovvero 90 punti oltre il suo predecessore. Anche i risultati nei test di coding si sono mossi nella stessa direzione.

Abbinato a Grok Build, il suo agente di coding proprietario, Grok 4.7 ha ottenuto 56 punti nel Coding Agent Index. Sono nove punti in più rispetto a Grok 4.6.

Il modello ha superato GPT-5.6 Sol e ora è dietro solo a Claude Fable 5.1 di Anthropic, GPT-6 Astra e Opus 5.

“Grok 4.7 ottiene 46 punti nell’Artificial Analysis Intelligence Index e porta SpaceXAI tra i primi 4 laboratori di AI. Anche il punteggio nel Coding Agent Index è migliorato, superando GPT-5.6 Sol,” si legge nel post.

Come si comporta Grok 4.7.
Come si comporta Grok 4.7. Fonte: X/Artificial Analysis

In altri test, il modello ha registrato incrementi minimi. Ha guadagnato 4,5 punti % su Terminal-Bench 4.0 e 3 punti su GDP.pdf. I punteggi sono invece scesi nei test AA-LCR e AutomationBench-AA. Grok 4.5 era stato in testa su AutomationBench a luglio, a sostegno delle affermazioni di Musk che lo volevano pari a Claude Opus.

I progressi arrivano con un conto di token

La tariffa non è cambiata. Grok 4.7 costa ancora $2 per ogni milione di token in input e $6 per ogni milione di token in output. I cache hits rimangono scontati a $0,50 e la finestra di contesto di 500.000 token resta invariata rispetto a Grok 4.6.

Tuttavia, il modello elabora molte più informazioni per ogni risposta. Artificial Analysis ha rilevato circa 81.000 token output per ogni task dell’Index, contro i 36.000 di Grok 4.6 e i 27.000 di GPT-6 Astra. Quindi, anche mantenendo il prezzo per token costante, il costo per ogni task risulta superiore.

Questo consumo di token pesa su una divisione che ha già riportato una perdita di 1,26 miliardi di dollari. Intanto Musk ha dichiarato, il 14 settembre, che Grok 4.8 finirà l’addestramento entro una settimana.

Si aspetta anche che Grok 5 sia il modello che raggiungerà una vera intelligenza artificiale generale. La prossima release verificherà se SpaceXAI riuscirà a scalare le classifiche senza dover consumare ancora più potenza di calcolo.

Iscriviti al nostro canale YouTube per seguire analisi approfondite di esperti e giornalisti

https://youtu.be/IcgIaeIE7LI

Disclaimer

BeInCrypto si impegna a garantire un'informazione imparziale e trasparente. Questo articolo di notizie si propone di fornire informazioni accurate e tempestive. Tuttavia, si consiglia ai lettori di verificare i fatti in modo indipendente e di consultare un professionista prima di prendere qualsiasi decisione basata su questo contenuto. Si prega di notare che i nostri Termini e Condizioni, la nostra Informativa sulla Privacy e i nostri Disclaimer sono stati aggiornati.

Contenuto sponsorizzato
Contenuto sponsorizzato