Kimi K3 is a 2.8T parameter open-weight multimodal reasoning model from Moonshot AI. It is suited for complex coding, knowledge work, and long-horizon agentic workflows, and is particularly strong at...
Catégorie de performance
Flagship
Kimi K3 est un modèle flagship de MoonshotAi : le plus performant de leur gamme.
Meilleur modèle de ce fournisseur. Performances maximales sur les benchmarks, idéal pour les tâches exigeantes.
Tarification
Ce modèle est inclus dans les plans Elosia
Élevé
Tarification élevée. Réservez ce niveau aux tâches qui exigent une qualité maximale.
Flagship de Moonshot à 2,8T de paramètres, activant 16 experts sur 896 par token (LatentMoE)
Raisonnement niveau recherche au sommet du domaine (GPQA Diamond 93,5 %), confirmé indépendamment par Artificial Analysis
Contexte de 1M de tokens, quatre fois la fenêtre 256K de la famille Kimi K2
Capacités de vision natives, avec un raisonnement multimodal solide (MMMU-Pro 81,6 %)
Kimi Delta Attention avec attention residuals, soit environ 2,5x l'efficacité de scaling de Kimi K2 selon Moonshot
Limites
Évaluation officielle Moonshot axée sur l'agentique, le raisonnement et la vision : MMLU, MATH-500 et HumanEval ne font pas partie de la suite rapportée
Réflexion toujours active et reasoning_effort limité à « max », donc aucun chemin instantané pour les appels simples
Modèle le plus cher de la gamme Kimi, de loin (3 $/M en entrée, 15 $/M en sortie)
Terminal-Bench 2.1 auto-déclaré à 88,3 %, alors que les mesures indépendantes sont plus basses (Artificial Analysis 85,0 %, Vals AI 80,9 %)