Grok

Grok 4.5

GrokFlagship
RaisonnementOutilsVisionSortie structurée

À propos de ce modèle

Grok 4.5 is SpaceXAI's smartest model with frontier performance on coding, knowledge work, and STEM.

Catégorie de performance

Flagship

Grok 4.5 est un modèle flagship de Grok : le plus performant de leur gamme.

Meilleur modèle de ce fournisseur. Performances maximales sur les benchmarks, idéal pour les tâches exigeantes.

Tarification

Ce modèle est inclus dans les plans Elosia
Modéré

Coût modéré. Bon équilibre pour un usage régulier sans surveillance constante du cap.

Typepar 1M tokens
Entrée (prompt)$2.00
Sortie (complétion)$6.00
Lecture cache$0.300

Capacités

Taille du contexte500K
Tokens de sortie max
TokenizerGrok
Entréetext, image, file
Sortietext
Date de sortie8 juillet 2026

Benchmarks

Intelligence générale
MMLU
Non reporté
GPQA Diamond
Non reporté
Mathématiques
MATH-500
Non reporté
Programmation
HumanEval
Non reporté
SWE-bench Verified
Non reporté
Raisonnement
IFEval
Non reporté
Agentique
SWE-bench Pro
64.7%
Terminal-Bench 2.1
83.3%

Où se situe Grok 4.5 ?

Comparez son indice de performance à tous les autres modèles.

Voir le classement performance

Usages recommandés

ProgrammationAnalyseRechercheChat généralMathématiques

Points forts

  • Flagship de xAI, solide en code, en tâches agentiques et en travail de connaissance STEM
  • Code agentique compétitif : 83,3 sur Terminal-Bench 2.1 et 64,7 sur SWE-bench Pro (single-model)
  • Notablement économe en tokens sur le code agentique face à des flagships comparables, à environ 80 tokens/seconde (selon xAI)
  • Fenêtre de contexte de 500K tokens avec entrée multimodale (texte, image), function calling, recherche web et X, et exécution de code

Limites

  • xAI n'a publié que des benchmarks de code et agentiques : ni MMLU, ni GPQA, ni maths, ni raisonnement pour évaluer une capacité plus large
  • En retrait des leaders actuels du code sur SWE-bench Pro (64,7 contre environ 80)
  • Écosystème d'outils tiers plus restreint que celui d'OpenAI ou Anthropic

Questions fréquentes

Ressources

Ce modèle peut utiliser vos données pour l'entraînement

Modèles similaires