Intelligence artificielle · Actualité

L'IA de SpaceX d'Elon Musk lance Grok 4.7 avec des améliorations en programmation, analyse juridique et tâches d'ingénierie

SpaceX AI a présenté Grok 4.7, un nouveau modèle d'intelligence artificielle (IA) avec des améliorations en programmation, analyse juridique et ingénierie, qui maintient le prix et la vitesse d'exécution de Grok 4.6 tout en élargissant sa capacité à résoudre des tâches complexes pendant des heures.

Le modèle a été entraîné sur une base nouvelle et plus grande que celle de son prédécesseur, combinée avec un apprentissage par renforcement prolongé. Cette méthode a été appliquée à des tâches complexes, contrairement à l'entraînement initial basé sur la lecture de millions de textes pour reconnaître les motifs linguistiques et les connaissances générales.

L'entreprise d'Elon Musk a affirmé que le système peut vérifier son propre travail et gérer des contextes étendus. Cette capacité permet de maintenir des conversations plus longues sans que l'utilisateur n'ait à répéter les informations fournies au début de l'échange.

Pour quoi Grok 4.7, l'intelligence artificielle d'Elon Musk, a été conçu

Grok 4.7 a été conçu pour la programmation avancée, la rédaction technique, l'analyse juridique et les tâches de bureau et d'ingénierie électrique. Il a été intégré dans CursorBench 4.0, un outil d'évaluation pour les tâches de programmation.

Dans le Harvey Legal Agent Benchmark, un test de travail juridique, le modèle a obtenu 19,6 %. Le score a triplé le 6,7 % de Fable 5.1 et était presque huit fois supérieur au 2,5 % enregistré par GPT-5.6 Sol Max.

La structure des prix fixe le coût d'utilisation à 2 dollars par entrée et 6 dollars par sortie. SpaceX AI a soutenu qu'en termes de sortie de résultats, Grok 4.7 est 8,3 fois moins cher que Fable 5.1 et 3,3 fois plus économique que Sol.

Cependant, Fable 5.1 Max a conservé un avantage dans l'exécution autonome du Terminal, avec 57,9 %, contre 38 % pour Grok 4.7 et le résultat de Sol d'OpenAI, situé à 20,6 points en dessous du leader. SpaceX AI propose une variante plus rapide qui double la vitesse de sortie pour le double du prix.

Comment SpaceX AI veut éviter que son IA perde le contrôle ou présente des risques

La nouvelle architecture d'atténuation des risques vise à réduire les tentatives de jailbreak, des techniques destinées à contourner les restrictions d'un système, et les accès malveillants. Dans HackerBench v0.3, une référence pour les demandes cybernétiques malveillantes, Grok 4.7 a bloqué 96,7 % des demandes d'utilisation nuisible.

Le modèle a été développé pour des domaines à double usage, comme la cybersécurité et le travail biologique, où une même capacité peut être employée à des fins défensives ou dangereuses. Dans l'indice de biosécurité de LatchBio, il a obtenu 62,4 %, selon l'entreprise.

SpaceX AI a indiqué que Grok 4.7 combine des capacités de cyberdéfense avec un faible taux de rejet des utilisations légitimes. La compagnie a commencé à accorder par invitation l'accès à des partenaires sélectionnés de cybersécurité pour utiliser les fonctions de type rouge du modèle dans des recherches de défense.

Quelles sont les autres nouveautés de SpaceX AI en matière d'intelligence artificielle

L'entreprise d'Elon Musk a lancé Grok Voice Transcribe 2.0, un modèle de reconnaissance vocale conçu pour convertir des conversations et des enregistrements audio en texte. L'entreprise a affirmé que la nouvelle génération double la précision de la précédente et peut être utilisée via son API de reconnaissance vocale.

Le système est basé sur le modèle audio utilisé par Grok Voice. Cette technologie traite des dizaines de milliers d'appels au service client par jour, transcrit des millions d'heures de narrations vidéo et permet de faire fonctionner des agents vocaux dans des produits physiques, y compris l'assistant Grok installé dans les véhicules Tesla.

Pour développer cette mise à jour, xAI a utilisé des enregistrements audio en direct avec du bruit de fond, différentes langues et divers environnements. Elle a ensuite appliqué des processus de post-entraînement pour améliorer le comportement du modèle dans des situations d'utilisation courantes.

Selon l'entreprise, Grok Voice Transcribe 2.0 occupe la première place en matière de précision parmi les 32 modèles de transcription analysés dans le classement public d'Artificial Analysis.