xAI lance Grok 4.7 : spécialisé dans la programmation et le travail de connaissances, le prix est réduit de moitié par rapport aux produits concurrents

📅 2026-09-22

Résumé :

xAI, la société d'intelligence artificielle d'Elon Musk, a officiellement lancé Grok 4.7, une nouvelle génération de grands modèles, et l'a positionné comme le modèle de programmation et de travail de connaissances le plus puissant actuellement. La société a déclaré que le nouveau modèle améliore non seulement les capacités de traitement de tâches complexes, mais maintient également la même vitesse de fonctionnement et le même système de prix que les produits de la génération précédente, et est compétitif sur le marché à moindre coût.

image.png

Selon les informations publiées par xAI, Grok 4.7 adopte un nouveau modèle de base à plus grande échelle et effectue une optimisation d'apprentissage par renforcement plus longue pendant le processus de formation. Par rapport aux versions précédentes, le nouveau modèle est exposé à des tâches de formation plus complexes, avec un grand nombre de tâches conçues pour durer plusieurs heures. Cela permet au modèle d'apporter des améliorations significatives au raisonnement à long terme, à l'auto-vérification et à la gestion des tâches complexes.

xAI a déclaré que l'un des changements les plus importants de Grok 4.7 est sa « capacité d'auto-test » plus renforcée. Les modèles peuvent vérifier de manière plus proactive leurs propres résultats lorsqu'ils répondent à des questions, écrivent du code et effectuent des tâches de connaissances complexes, réduisant ainsi les taux d'erreur et améliorant la fiabilité des résultats finaux.

Dans le même temps, la capacité du nouveau modèle à gérer des contextes extrêmement longs a également été améliorée. Face à des documents volumineux, à de multiples séries de tâches et à des travaux de projet de longue durée, Grok 4.7 peut maintenir des capacités de gestion des informations plus stables sans dégradation évidente des performances à mesure que le contexte évolue comme certains modèles traditionnels.

Afin d'améliorer encore l'expérience de travail réelle, xAI forme également spécialement Grok 4.7 pour qu'il comprenne nativement le cadre d'exploitation de Grok Bot. Cela signifie qu'il est non seulement adapté aux scénarios de questions et réponses ponctuelles, mais également plus adapté à la participation à des flux de travail en tant qu'agent intelligent de longue durée. La société estime que cela améliorera les performances du modèle dans les travaux de connaissances générales, les conversations en cours et les tâches au niveau de l'entreprise.

En plus des capacités de programmation, Grok 4.7 est également doté de capacités plus puissantes de création de documents et de présentations. Les responsables ont déclaré que le modèle est désormais mieux à même de générer des rapports professionnels, des documents commerciaux et des supports de présentation, et espèrent étendre davantage son champ d'application dans le domaine de la bureautique.

En termes de performances, xAI a annoncé une série de résultats de tests internes.

Dans le test CursorBench 4.0, utilisé pour évaluer les capacités d'ingénierie logicielle à long terme, Grok 4.7 a obtenu un score de 46,3 %, ce qui est considérablement amélioré par rapport aux 40,4 % de Grok 4.6. Lors du test d'ingénierie logicielle DeepSWE, le nouveau modèle a obtenu un score de 71 %, continuant à maintenir un niveau compétitif proche des produits leaders du secteur.

Lors du test EEBench dans le domaine de l'ingénierie électronique, Grok 4.7 a obtenu un score de 64 %, soit une augmentation de plus de dix points de pourcentage par rapport à la génération précédente. Pour les tâches bureautiques impliquant une grande quantité de connaissances professionnelles et des flux de travail complexes, les performances du modèle dans le test AA Briefcase se sont également améliorées.

En termes d'analyse juridique, Grok 4.7 a obtenu un score de 19,6 % au test Harvey Legal Agent Benchmark, ce qui constitue une nouvelle amélioration par rapport au produit de la génération précédente. Dans le domaine du raisonnement médical, les scores HealthBench Professional se sont également améliorés, passant de 48,5 % à 56,7 %.

Dans le domaine des travaux de culture générale, xAI a particulièrement souligné les deux résultats d'évaluation de GDPval et AA Briefcase. La société estime que ces tests sont plus proches du contenu réel du travail de professionnels tels que les avocats, les infirmières et les analystes financiers, et Grok 4.7 a atteint le niveau compétitif des modèles de pointe actuels dans ces scénarios.

image.png

image.png

image.png

Le prix est un autre argument de vente important de cette version.

image.png

Selon les données officielles, le prix d'entrée de Grok 4.7 reste à 2 USD par million de jetons, et le prix de sortie est de 6 USD par million de jetons, ce qui est cohérent avec Grok 4.6. Par rapport à certains modèles de pointe qui coûtent souvent plusieurs fois, voire dix fois plus, xAI souligne que Grok 4.7 peut accomplir des tâches d'un niveau similaire à moindre coût.

La société la décrit même comme une solution qui « offre des performances compétitives à environ la moitié du prix des modèles du même niveau », dans l'espoir d'élargir davantage sa part de marché avec un avantage en termes de coût.

En termes de sécurité, xAI a déclaré que Grok 4.7 adopte un système de protection de sécurité récemment reconstruit. Selon les résultats des tests internes, le nouveau modèle a atteint le meilleur niveau de la série Grok en termes de rejet des demandes dangereuses, de résistance aux attaques de jailbreak et d'identification des contenus à haut risque.

En particulier dans les domaines sensibles tels que la cybersécurité et la biosécurité, les modèles sont conçus pour aider à répondre aux tâches défensives légitimes tout en refusant les utilisations dangereuses ou malveillantes. Les données officielles montrent que Grok 4.7 a obtenu des performances de premier plan dans certains tests de risques de sécurité des réseaux et évaluations de biosécurité.

Actuellement, Grok 4.7 est ouvert aux utilisateurs via l'API et la plateforme Grok. Les développeurs peuvent appeler ce modèle pour la programmation, les questions et réponses sur les connaissances, la rédaction de documents et le développement d'applications d'agents intelligents.

Avec le lancement officiel de Grok 4.7, xAI a encore accéléré le rythme des itérations des produits. Depuis la sortie de Grok 4.5 en juillet de cette année, jusqu'au lancement de Grok 4.6 en août, et maintenant Grok 4.7, xAI a réalisé trois mises à niveau majeures en moins de trois mois. Pour le marché extrêmement concurrentiel de l’intelligence artificielle, Grok 4.7 n’est pas seulement une mise à jour régulière, mais montre également l’intention stratégique de xAI de défier les leaders du secteur grâce à des itérations plus rapides, des prix plus bas et des capacités de travail plus fortes.

Tags associés

Articles similaires

Commentaires

0/500
Captcha (click to refresh)
Aucun commentaire