Grok 4.5 casse les prix, GPT-Live donne de la voix

SpaceXAI lance Grok 4.5, un modèle qui ne domine pas franchement les benchmarks mais qui attaque ses rivaux là où ça fait mal : la facture des tokens. OpenAI, de son côté, a dévoilé de nouveaux modèles vocaux. Les modèles Grok sont restés dans l’ombre des géants Claude et GPT, mais xAI (qu’il faut…
Résumé
Grok 4.5 : performance modérée
SpaceXAI, anciennement connu sous le nom de xAI, a lancé Grok 4.5, un modèle d'intelligence artificielle qui ne se distingue pas comme le meilleur dans les tests de performance (benchmarks), mais qui reste compétitif.
Par exemple, sur le test DeepSWE 1.1, Grok 4.5 obtient 53 % de bonnes réponses, derrière des modèles comme Fable max ou GPT-5.5 xhigh.
En revanche, il se rapproche des leaders sur Terminal Bench 2.1 avec 83,3 %, presque égal à GPT-5.5 (83,4 %).
Sur SWE Bench Pro, il devance GPT-5.5 (64,7 % contre 58,6 %), mais reste derrière Opus 4.8 et Fable max.
Ces résultats montrent que Grok 4.5 n'est pas un modèle révolutionnaire, mais qu'il offre des performances correctes dans certains domaines, notamment la programmation.
Lire l'analyse complète en 6 points →
Commentaires (0)
Connecte-toi pour commenter
Se connecterAucun commentaire pour le moment.
Voir aussi
Plus de contenus dans cette catégorie →Découvre plus de contenu sur Napseflow


