xAI a récemment annoncé le lancement de Grok 4.7, son modèle le plus performant à ce jour, qui promet d'être une "amélioration notable" par rapport à Grok 4.6, tout en conservant le même prix. Toutefois, en se basant sur les benchmarks, Grok 4.7 se positionne toujours en deuxième place, décevant ceux qui espéraient une avancée plus significative.
Ce lancement a lieu après plusieurs délais surprenants. Elon Musk a annoncé des dates de lancement, les faisant reculer à maintes reprises en passant de "quatre semaines" à "une dizaine de jours", puis à finalement "besoin de quelques jours supplémentaires à cuire". Cette attente a contribué à créer des attentes élevées autour de la sortie de Grok 4.7.
Des caractéristiques techniques renforcées
Grok 4.7 est livrée avec 2,1 trillions de paramètres, représentant une augmentation de 40 % par rapport aux 1,5 trillion de Grok 4.6. Les coûts d'utilisation sont de 2 $ par million de tokens d'entrée et de 6 $ par million de tokens de sortie, des chiffres qui se situent sous ceux de ses principaux concurrents, tout en étant attractifs pour les utilisateurs souhaitant maximiser leur investissement.
xAI a également intégré des données issues de SpaceX, notamment des télémetries de satellites Starlink et des journaux d'échec d'ingénierie, ce qui promet d'améliorer le raisonnement concernant les systèmes matériels par rapport à des modèles formés uniquement sur des textes issus d'Internet.
Benchmarking face à la concurrence
Malgré ces avancées, Grok 4.7 continue de tester les mêmes limites que ses prédécesseurs. Sur le benchmark GDPval, qui évalue la performance des modèles sur des tâches à valeur économique réelle, Grok 4.7 a atteint un score de 1695, tout en étant devancé par Claude Fable 5.1 avec un score de 1735.
De même, sur le benchmark AA-Briefcase, qui simule plusieurs heures de travail de bureau, Grok 4.7 a obtenu un score de 1657, encore une fois derrière Claude Fable 5.1 avec 1678. Dans le domaine du codage, avec le test CursorBench, Grok 4.7 a également dû faire face à une concurrence accrue, se positionnant au milieu du peloton derrière des modèles plus performants comme GPT-6 Astra.
Stratégie tarifaire et accessibilité
L'un des principaux atouts de xAI réside dans sa tarification. En offrant des coûts plus bas par token par rapport à ses principaux concurrents comme Anthropic et OpenAI, xAI attire de nombreux utilisateurs qui souhaitent tirer parti d'une intelligence artificielle fonctionnelle sans débourser des sommes trop élevées. Cette approche, bien que tactique, signifie que le produit est particulièrement destiné aux utilisateurs quotidiens.
Elon Musk semble également être conscient des limites de Grok 4.7 en plaçant ses attentes relativement bas. Il mentionne avec prudence que Grok 4.7 est "à peu près au même niveau que" Claude Opus 5.0, tout en soulignant que les performances multimodales nécessitent encore des améliorations. La manière dont xAI a décidé de se positionner sur le marché de l'IA montre un focus sur l'accessibilité et la suffissance pour les tâches quotidiennes, plutôt que d'essayer de rivaliser avec les modèles les plus avancés.
Un avenir incertain pour Grok
En regardant vers l'avenir, Musk a esquissé des plans pour Grok 4.8, 4.9 et 5, qui pourraient potentiellement combler l'écart en termes de performance et rivaliser avec les meilleurs modèles du marché. Cependant, aucune date de sortie pour ces modèles améliorés n'a encore été annoncée, laissant les utilisateurs dans l'incertitude quant à la direction future que prendra xAI.
Malgré ses limitations, Grok 4.7 demeure un modèle solide pour les millions d'utilisateurs qui interagissent avec lui à travers différents canaux, y compris les applications autonomes et les interfaces des véhicules Tesla. Bien que cela souligne la nécessité pour xAI de continuer à évoluer, il est clair que pour l'instant, la niche de marché que vise la plateforme est largement occupée par des utilisateurs cherchant un compromis entre performance et coût.
Questions fréquentes
Grok 4.7 est-il supérieur à Grok 4.6 ?
Oui, Grok 4.7 est considéré comme une amélioration notable par rapport à Grok 4.6 grâce à un nombre accru de paramètres et à une formation supplémentaire basée sur les données de SpaceX.
Pourquoi Grok 4.7 est-il moins performant que d'autres modèles ?
Malgré ses améliorations, Grok 4.7 se classe derrière d'autres modèles comme Claude Fable 5.1 et GPT-6 Astra en raison de scores de benchmark moins élevés.
Quels sont les plans futurs pour la série Grok ?
Elon Musk a mentionné des versions futures, y compris Grok 4.8, 4.9 et 5, qui visent à améliorer les performances, mais aucune date de lancement n'a été fournie.