MoonshotAi

Kimi K3

MoonshotAiFlagship
RaisonnementOutilsVisionSortie structurée

À propos de ce modèle

Kimi K3 is a 2.8T parameter open-weight multimodal reasoning model from Moonshot AI. It is suited for complex coding, knowledge work, and long-horizon agentic workflows, and is particularly strong at...

Catégorie de performance

Flagship

Kimi K3 est un modèle flagship de MoonshotAi : le plus performant de leur gamme.

Meilleur modèle de ce fournisseur. Performances maximales sur les benchmarks, idéal pour les tâches exigeantes.

Tarification

Ce modèle est inclus dans les plans Elosia
Élevé

Tarification élevée. Réservez ce niveau aux tâches qui exigent une qualité maximale.

Typepar 1M tokens
Entrée (prompt)$3.00
Sortie (complétion)$15.00
Lecture cache$0.300

Capacités

Taille du contexte1.0M
Tokens de sortie max
TokenizerOther
Entréetext, image
Sortietext
Date de sortie16 juillet 2026

Benchmarks

Intelligence générale
MMLU
Non reporté
GPQA Diamond
93.5%
Mathématiques
MATH-500
Non reporté
Programmation
HumanEval
Non reporté
SWE-bench Verified
Non reporté
Raisonnement
IFEval
Non reporté
Humanity's Last Exam
56%
Multimodalité
MMMU-Pro
81.6%
Agentique
Terminal-Bench 2.1
88.3%

Où se situe Kimi K3 ?

Comparez son indice de performance à tous les autres modèles.

Voir le classement performance

Usages recommandés

ProgrammationAnalyseRechercheChat général

Points forts

  • Flagship de Moonshot à 2,8T de paramètres, activant 16 experts sur 896 par token (LatentMoE)
  • Raisonnement niveau recherche au sommet du domaine (GPQA Diamond 93,5 %), confirmé indépendamment par Artificial Analysis
  • Contexte de 1M de tokens, quatre fois la fenêtre 256K de la famille Kimi K2
  • Capacités de vision natives, avec un raisonnement multimodal solide (MMMU-Pro 81,6 %)
  • Kimi Delta Attention avec attention residuals, soit environ 2,5x l'efficacité de scaling de Kimi K2 selon Moonshot

Limites

  • Évaluation officielle Moonshot axée sur l'agentique, le raisonnement et la vision : MMLU, MATH-500 et HumanEval ne font pas partie de la suite rapportée
  • Réflexion toujours active et reasoning_effort limité à « max », donc aucun chemin instantané pour les appels simples
  • Modèle le plus cher de la gamme Kimi, de loin (3 $/M en entrée, 15 $/M en sortie)
  • Terminal-Bench 2.1 auto-déclaré à 88,3 %, alors que les mesures indépendantes sont plus basses (Artificial Analysis 85,0 %, Vals AI 80,9 %)

Questions fréquentes

Ressources

Ce modèle peut utiliser vos données pour l'entraînement

Modèles similaires