Daily Beirut

IA

SpaceXAI lance son nouveau modèle Grok 4.7. Découvrez ses avantages et capacités

SpaceXAI a lancé son nouveau modèle d'IA Grok 4.7, conçu pour des tâches complexes en programmation et travail professionnel, avec une capacité accrue à travailler de manière autonome sur de longues périodes.

··8 min de lecture
SpaceXAI lance son nouveau modèle Grok 4.7. Découvrez ses avantages et capacités
Partager

SpaceXAI a lancé son nouveau modèle d'intelligence artificielle Grok 4.7, marquant une avancée dans sa présence sur le marché des modèles orientés vers la programmation et l'exécution de tâches professionnelles complexes, en mettant particulièrement l'accent sur la capacité du modèle à fonctionner de manière autonome pendant de longues périodes, à utiliser des outils et à vérifier son propre travail avant de fournir une réponse finale.

L'entreprise décrit Grok 4.7 comme son modèle le plus puissant à ce jour en matière de programmation et de tâches cognitives, confirmant qu'il est désormais capable de poursuivre des tâches difficiles, de vérifier son travail et de gérer de grandes quantités d'informations au sein d'une seule conversation.

Ce lancement intervient après que xAI soit devenu une division de SpaceX, annonce faite en février dernier, selon laquelle SpaceX a acquis l'entreprise d'intelligence artificielle fondée par Elon Musk, dont les produits et services sont désormais proposés sous le nom de SpaceXAI.

SpaceXAI a basé Grok 4.7 sur un nouveau modèle de base plus volumineux que celui utilisé dans la version précédente, Grok 4.6, bien que l'entreprise n'ait pas révélé le nombre de paramètres ni les détails complets de l'architecture du nouveau modèle.

Cela représente un changement clair par rapport aux premières générations de Grok : en 2024, l'entreprise avait dévoilé les spécifications de Grok-1, basé sur 314 milliards de paramètres et une architecture « Mélange d'Experts » (Mixture-of-Experts, MoE), avant que les générations suivantes ne s'orientent vers des modèles plus évolués et davantage orientés vers l'usage commercial et les agents.

Mais l'augmentation de taille n'est pas le changement le plus important avec Grok 4.7 : SpaceXAI affirme avoir soumis le modèle à une période de formation prolongée utilisant l'apprentissage par renforcement (Reinforcement Learning), avec une série de problèmes plus difficiles et un poids accru accordé aux tâches pouvant prendre plusieurs heures à accomplir.

Cela signifie concrètement que l'entreprise ne vise pas seulement à améliorer la capacité du modèle à répondre à une question isolée, mais à l'entraîner à poursuivre une tâche longue composée de dizaines ou même de centaines d'étapes.

Par exemple, il existe une différence significative entre demander à un modèle intelligent de rédiger un petit extrait de code et lui confier un projet logiciel complet, puis lui demander d'ajouter un système de connexion utilisateur, de modifier tous les fichiers concernés, d'exécuter des tests, de détecter les erreurs causées par les modifications, de les corriger, puis de revoir le résultat final.

Cette deuxième catégorie de tâches exige que le modèle conserve constamment à l'esprit l'objectif initial, se souvienne des étapes déjà accomplies et revienne sur des décisions antérieures si elles s'avèrent erronées — précisément ce type de défis sur lequel SpaceXAI a concentré son entraînement de Grok 4.7.

L'une des améliorations majeures soulignées par l'entreprise est la capacité de Grok 4.7 à mieux vérifier son propre travail (Self-verification).

Lorsqu'on charge le modèle, par exemple, d'analyser des dizaines de fichiers financiers et de créer une présentation sur la performance d'une entreprise, il devrait être plus apte à détecter la présence d'un chiffre dans une diapositive qui ne correspond pas aux données du fichier original, ou à remarquer qu'un total partiel ne correspond pas au total indiqué dans le rapport, puis revenir aux données pour les vérifier avant de livrer le travail.

Mais cela ne signifie pas que Grok 4.7 est immunisé contre les erreurs ou les « hallucinations », seulement que le processus d'entraînement encourage davantage le modèle à examiner ses propres étapes et à les vérifier.

SpaceXAI a indiqué que le modèle présente un taux limité d'« hallucinations », mais l'entreprise n'a pas fourni dans son communiqué de lancement un chiffre standardisé permettant de mesurer et comparer le taux d'erreurs informationnelles avec ceux de tous ses concurrents.

500 000 tokens par tâche

Grok 4.7 propose une fenêtre contextuelle allant jusqu'à 500 000 tokens, soit la quantité d'information que le modèle peut conserver et traiter au sein d'une seule tâche.

Un « token » est l'unité utilisée pour diviser les textes dans les modèles d'IA durant le traitement, pouvant être une mot entier ou une partie d'un mot, d'où l'absence d'équivalence fixe entre le nombre de tokens et le nombre de mots.

En pratique, cette nouvelle taille permet d'insérer des centaines de milliers de mots dans le même contexte, comme présenter un grand ensemble de contrats, de rapports ou de parties étendues d'un projet logiciel, puis poser des questions nécessitant de relier des informations dispersées dans ces fichiers. SpaceXAI affirme que l'amélioration ne concerne pas seulement la taille de la fenêtre contextuelle, mais aussi la capacité du modèle à la gérer sur de longues périodes.

C'est une différence fondamentale : il ne serait pas utile que le modèle puisse recevoir 500 000 tokens s'il perdait la capacité à rappeler des détails importants mentionnés au début de la tâche lorsqu'il atteint les phases finales.

4 niveaux de raisonnement

SpaceXAI permet aux développeurs de contrôler le niveau d'effort de raisonnement (Reasoning Effort) que utilise Grok 4.7 avant de fournir une réponse, via quatre niveaux : Low, Medium, High et xHigh, le niveau High étant actif par défaut.

Le niveau Low consacre moins d'opérations d'inférence, le rendant adapté aux tâches simples ou aux applications nécessitant une réponse rapide.

Le niveau Medium pousse le modèle à consacrer davantage de calculs à l'analyse des données et aux tâches reposant sur un contexte long, tandis que le niveau High cible les problèmes complexes et les raisonnements logiques à plusieurs étapes.

Le niveau xHigh alloue la capacité maximale du modèle à raisonner avant de répondre, donc il convient aux problèmes où la précision du résultat prime sur la rapidité de la réponse.

Grok devient un agent intelligent

Grok 4.7 reflète également l'évolution accélérée du marché de l'IA vers les agents intelligents (AI Agent).

SpaceXAI décrit son nouveau modèle comme prêt à être utilisé avec des outils externes via un appel agencé (Agentic Tool Calling), ce qui va au-delà de la simple fourniture d'une réponse textuelle : le modèle peut identifier l'outil nécessaire pour effectuer une étape spécifique, l'utiliser, analyser le résultat et déterminer la prochaine étape.

L'entreprise propose via sa plateforme pour développeurs des outils permettant au modèle de rechercher sur Internet, de chercher sur la plateforme « X », d'exécuter des codes, de manipuler des bases de données et des documents, ainsi que de communiquer avec des systèmes externes via le protocole MCP.

Ainsi, au lieu de demander simplement « rédigez un rapport sur la performance d'une entreprise », dans un environnement approprié, l'agent peut rechercher les dernières données de l'entreprise, consulter les documents internes accessibles à l'utilisateur, effectuer les calculs requis, puis rédiger le rapport ou préparer une présentation basée sur les résultats.

SpaceXAI a clairement mis l'accent sur l'utilisation de Grok 4.7 dans les tâches administratives et professionnelles, affirmant que le modèle excelle désormais dans la création de documents et de présentations.

L'entreprise a testé ces capacités à travers des évaluations telles que GDPval et AA Briefcase, visant à mesurer les performances des modèles d'IA dans des tâches similaires à celles réalisées par les avocats, analystes financiers, professionnels de santé et autres experts.

Avantages et capacités de Grok 4.7

L'un des principaux atouts de SpaceXAI avec ce nouveau modèle est son prix : l'accès à Grok 4.7 via l'API commence à 2 dollars par million de tokens d'entrée et 6 dollars par million de tokens de sortie, le même tarif que pour Grok 4.6. Une version accélérée du modèle double la vitesse de génération de texte au prix doublé.

En comparaison, le prix de GPT-6 Astra s'élève à environ 10 dollars par million de tokens d'entrée et 50 dollars pour la sortie, des tarifs similaires à ceux d'Anthropic pour Claude Fable 5.1.

Ainsi, Grok est nettement moins cher que ces deux modèles, mais il ne peut pas être considéré comme le plus abordable parmi tous les concurrents, car Google propose actuellement Gemini 3.8 Flash à un prix promotionnel inférieur.

Outre le développement des capacités, SpaceXAI affirme avoir entièrement reconstruit la pile de sécurité (Safeguard Stack) utilisée avec Grok 4.7.

L'entreprise décrit le modèle comme le plus puissant qu'elle ait jamais testé en matière de refus des requêtes dangereuses et de résistance aux tentatives de contournement des systèmes de sécurité (Jailbreaks).

SpaceXAI a également commencé à offrir un accès privilégié aux capacités de « Red Team » dans Grok 4.7 à un groupe sélectionné de partenaires dans le domaine de la cybersécurité, afin de les utiliser pour des recherches défensives.

L'importance de ce volet croît avec l'augmentation des capacités des modèles d'IA en cybersécurité : le dernier modèle d'OpenAI, GPT-6 Astra, est devenu le premier modèle de la société à atteindre la classification « Critical » en termes de capacités cybernétiques selon leur cadre de préparation, ce qui signifie, selon OpenAI, qu'il peut, lorsqu'il est doté des outils et autorisations appropriés, détecter des failles inconnues et développer des moyens d'exploitation sans besoin d'instructions humaines pour chaque étape.

SpaceXAI fixe mai 2026 comme date limite pour les informations intégrées dans l'entraînement de Grok 4.7, donc le modèle n'a pas automatiquement connaissance des événements survenus après cette date.

Pour accéder à des informations actualisées, il faut activer des outils de recherche sur Internet ou effectuer une recherche sur la plateforme « X ».

Ajoutez Daily Beirut à votre fil Google News pour recevoir l'info en priorité.
Partager