DeepSeek V4 Flash 0731 is a sparse mixture-of-experts model from DeepSeek, with 13B active parameters out of 284B total. This re-post-trained revision is suited for coding, reasoning, and agent workflows....
Catégorie de performance
Équilibré
DeepSeek v4 Flash 0731 est un modèle équilibré de DeepSeek : un bon compromis entre bonnes performances à un prix raisonnable.
Bon rapport coût-performance. Fiable pour la plupart des usages professionnels sans tarification premium.
Tarification
Ce modèle est inclus dans les plans Elosia
Éco
Coût minimal. Idéal pour le très haut volume ou les tâches simples.
Mixture of experts avec 13B de paramètres actifs par token, puisés dans 256 experts routés plus un partagé, six engagés à la fois
Exécution agentique et code évaluée sur quatre suites distinctes, couvrant les workflows terminal, les correctifs de dépôts, les tâches de sécurité et l'usage d'outils
Speculative decoding intégré au checkpoint : le module DSpark est livré avec les poids plutôt qu'ajouté au moment du service
Poids ouverts MIT réellement auto-hébergeables, recettes vLLM et SGLang officielles, tool calling avec parallel_tool_calls, contexte 1M et 384K de sortie
Limites
Rappel factuel faible : sur les questions dont il ne connaît pas la réponse, il répond quand même bien plus souvent qu'il ne s'abstient. Le point fort porte sur l'agentique et le code, pas sur la densité de connaissances
Chiffres officiels non reproductibles, le « DeepSeek Harness » n'étant pas publié : les résultats annoncés ne peuvent pas être rejoués en interne. Raisonnement verbeux également en effort maximum, ce qui pèse sur la latence et sur le budget de tokens