Tencent

Tencent Hy3

TencentÉquilibré
RaisonnementOutilsSortie structurée

À propos de ce modèle

Hy3 is a 295B-parameter Mixture-of-Experts model from Tencent (21B active, 192 experts with top-8 routing) built for reasoning, agentic workflows, and real-world production use. It supports a configurable reasoning effort:...

Catégorie de performance

Équilibré

Tencent Hy3 est un modèle équilibré de Tencent : un bon compromis entre bonnes performances à un prix raisonnable.

Bon rapport coût-performance. Fiable pour la plupart des usages professionnels sans tarification premium.

Tarification

Ce modèle est inclus dans les plans Elosia
Abordable

Coût réduit. Adapté à un usage soutenu et aux interactions volumineuses.

Typepar 1M tokens
Entrée (prompt)$0.132
Sortie (complétion)$0.528
Lecture cache$0.033

Capacités

Taille du contexte262K
Tokens de sortie max128K
TokenizerOther
Entréetext
Sortietext
Date de sortie6 juillet 2026

Benchmarks

Intelligence générale
MMLU
Non reporté
GPQA Diamond
90.4%
Mathématiques
MATH-500
Non reporté
Programmation
HumanEval
Non reporté
SWE-bench Verified
78%
SWE-bench Multilingual
75.8%
Raisonnement
Humanity's Last Exam
37%
Agentique
SWE-bench Pro
57.9%
Terminal-Bench 2.1
71.7%

Où se situe Tencent Hy3 ?

Comparez son indice de performance à tous les autres modèles.

Voir le classement performance

Usages recommandés

ProgrammationRechercheAnalyseChat général

Points forts

  • Mixture of experts sparse : 192 experts en routage top-8 sur 80 couches, chaque token n'engageant qu'une petite part du réseau
  • La recherche agentique est un axe d'évaluation explicite, avec des suites de navigation multi-étapes et de recherche approfondie reportées aux côtés du code et du raisonnement
  • Ouverture réelle : poids Apache 2.0 et variante FP8 publiée, déploiement vLLM et SGLang documenté, et seulement 21B de paramètres actifs sur 295B, ce qui limite le calcul par token
  • Tool calling via un parser hy_v3 dédié, sur une fenêtre de contexte de 262K tokens avec jusqu'à 128K en sortie

Limites

  • Couverture factuelle faible : face à une question qu'il ne maîtrise pas, il invente plus souvent qu'il ne s'abstient, ce qui relativise la revendication anti-hallucination de la fiche
  • Mathématiques de compétition en retrait, dans la table de Tencent elle-même, loin derrière son raisonnement scientifique. Texte seul, aucune multimodalité

Questions fréquentes

Ressources

Ce modèle peut utiliser vos données pour l'entraînement

Modèles similaires