La société SpaceXAI a annoncé le lancement d'une nouvelle version de son modèle d'intelligence artificielle, baptisée Grok 4.7, qu'elle présente comme un modèle spécialement conçu pour les tâches de programmation et les travaux intellectuels complexes pouvant prendre plusieurs heures à réaliser.
Selon l’entreprise, ce nouveau modèle a obtenu des résultats avancés lors de plusieurs tests standardisés, notamment CursorBench v4.0, où il a, selon elle, surpassé GPT-5.6 Sol, tout en restant légèrement derrière Fable 5.1 Max.
Améliorations dans le traitement des contextes longs
L’entreprise a précisé que Grok 4.7 est désormais plus à même de vérifier de manière autonome la qualité de ses résultats et de gérer des contextes longs, tout en améliorant ses performances dans les tâches liées au travail de bureau, à l’analyse juridique et à l’ingénierie.
Elle a également mis l’accent sur le développement de mécanismes de protection, soulignant que le modèle est désormais plus à même de détecter les requêtes dangereuses et de contrer les tentatives de contournement des restrictions de sécurité.
Lors du test HackerBench v0.3, destiné à évaluer la réponse à des tâches cybernétiques potentiellement dangereuses, l’entreprise a déclaré que le modèle n’avait laissé passer que 3,3 % des requêtes classées comme présentant un risque élevé.
Des tarifs bas par rapport à la concurrence
L’un des principaux atouts sur lesquels mise l’entreprise avec Grok 4.7 est sa tarification : le coût d’utilisation a été fixé à 2 dollars par million de symboles d’entrée, contre 6 dollars par million de symboles de sortie.
Selon l’annonce, la nouvelle version est d’ores et déjà disponible via l’API Grok, ainsi que sur les plateformes Cursor et Grok Build.
Avec cette version, l’entreprise cherche à renforcer la présence de son modèle sur le marché des outils d’intelligence artificielle destinés aux développeurs et aux professionnels, en mettant l’accent sur la programmation, les tâches étendues, la sécurité et la réduction du coût d’utilisation.
