Kimi K3 obtient 1 543 points Elo dans le benchmark « cols blancs », coûte 10 fois plus cher que K2.6

D’après le benchmark AA-Briefcase actualisé d’Artificial Analysis, Kimi K3 a atteint 1543 points Elo, dépassant seulement Claude Fable 5 (1574) et surpassant GPT-5.6 Sol (1501). Le benchmark évalue les modèles sur l’extraction d’informations, l’analyse de documents et la génération de livrables à travers 91 tâches confidentielles.

Cependant, les gains de performance de K3 s’accompagnent de coûts nettement plus élevés : 10,57 dollars par tâche, soit environ 10 fois ceux de Kimi K2.6. Le modèle a effectué en moyenne 83 itérations et a généré 120 000 tokens par tâche, nécessitant 56,4 minutes pour aboutir—environ 2,5 fois plus longtemps que Fable 5.

Avertissement : Les informations figurant sur cette page peuvent provenir de sources tierces et sont fournies à titre indicatif uniquement. Elles ne reflètent pas les points de vue ou opinions de Gate et ne constituent pas un conseil financier, d’investissement ou juridique. Le trading des actifs virtuels comporte des risques élevés. Veuillez ne pas vous fonder uniquement sur les informations de cette page pour prendre vos décisions. Pour en savoir plus, consultez l’avertissement.
Commentaire
0/400
Aucun commentaire