SpaceXAI ha rilasciato Grok 4.7 e valutazioni indipendenti lo posizionano al quarto posto tra i principali laboratori di intelligenza artificiale.
Artificial Analysis, una società indipendente di benchmarking, ha assegnato al modello un punteggio di 46 sul suo Intelligence Index, 2 punti in più rispetto a Grok 4.6. Claude Fable 5.1, GPT-6 Astra e Claude Opus 5 ottengono però punteggi ancora superiori.
Grok 4.7 spinge SpaceXAI nella top quattro dei laboratori di AI
Elon Musk aveva dichiarato prima del lancio che il modello sarebbe stato basato su 2,1 trilioni di parametri e avrebbe superato tutti i modelli attuali. Ha aggiunto che l’addestramento del modello ha incluso anche dati aziendali di SpaceX.
Seguici su X per ricevere le ultime notizie in tempo reale
Ma come si comporta davvero Grok 4.7? Su AA-Briefcase, un benchmark ideato da Artificial Analysis per valutare compiti professionali realistici, Grok 4.7 ha ottenuto un punteggio Elo di 1.657. Si tratta di un balzo di 111 punti rispetto a Grok 4.6, portando il livello del modello vicino a quello di Claude Opus 5.
Su GDPval-AA, il modello ha raggiunto un Elo di 1.695, ovvero 90 punti oltre il suo predecessore. Anche i risultati nei test di coding si sono mossi nella stessa direzione.
Abbinato a Grok Build, il suo agente di coding proprietario, Grok 4.7 ha ottenuto 56 punti nel Coding Agent Index. Sono nove punti in più rispetto a Grok 4.6.
Il modello ha superato GPT-5.6 Sol e ora è dietro solo a Claude Fable 5.1 di Anthropic, GPT-6 Astra e Opus 5.
“Grok 4.7 ottiene 46 punti nell’Artificial Analysis Intelligence Index e porta SpaceXAI tra i primi 4 laboratori di AI. Anche il punteggio nel Coding Agent Index è migliorato, superando GPT-5.6 Sol,” si legge nel post.
In altri test, il modello ha registrato incrementi minimi. Ha guadagnato 4,5 punti % su Terminal-Bench 4.0 e 3 punti su GDP.pdf. I punteggi sono invece scesi nei test AA-LCR e AutomationBench-AA. Grok 4.5 era stato in testa su AutomationBench a luglio, a sostegno delle affermazioni di Musk che lo volevano pari a Claude Opus.
I progressi arrivano con un conto di token
La tariffa non è cambiata. Grok 4.7 costa ancora $2 per ogni milione di token in input e $6 per ogni milione di token in output. I cache hits rimangono scontati a $0,50 e la finestra di contesto di 500.000 token resta invariata rispetto a Grok 4.6.
Tuttavia, il modello elabora molte più informazioni per ogni risposta. Artificial Analysis ha rilevato circa 81.000 token output per ogni task dell’Index, contro i 36.000 di Grok 4.6 e i 27.000 di GPT-6 Astra. Quindi, anche mantenendo il prezzo per token costante, il costo per ogni task risulta superiore.
Questo consumo di token pesa su una divisione che ha già riportato una perdita di 1,26 miliardi di dollari. Intanto Musk ha dichiarato, il 14 settembre, che Grok 4.8 finirà l’addestramento entro una settimana.
Si aspetta anche che Grok 5 sia il modello che raggiungerà una vera intelligenza artificiale generale. La prossima release verificherà se SpaceXAI riuscirà a scalare le classifiche senza dover consumare ancora più potenza di calcolo.
Iscriviti al nostro canale YouTube per seguire analisi approfondite di esperti e giornalisti









