Kimi K3はホワイトカラー部門のベンチマークでElo 1543を獲得し、K2.6の10倍のコストがかかります。

Artificial Analysisの更新済みAA-Briefcaseベンチマークによると、Kimi K3は1543 Eloポイントを達成し、Claude Fable 5の1574に次ぐ結果となりました。GPT-5.6 Solはこれを上回りました。

このベンチマークでは、91件の機密タスクにわたって、モデルを情報抽出、ドキュメント分析、成果物生成の各観点で評価します。

しかし、K3のパフォーマンス向上には大幅に高いコストがかかりました。1タスクあたり$10.57で、これはKimi K2.6の約10倍です。モデルの平均は83回の反復で、1タスクあたり120,000トークンを生成し、完了までに56.4分を要しました。これはFable 5の約2.5倍の長さです。

免責事項:本ページの情報には第三者提供の内容が含まれる場合があり、参考目的のみで提供されています。これらはGateの見解や意見を示すものではなく、金融、投資、または法律上の助言を構成するものでもありません。暗号資産取引には高いリスクが伴います。意思決定を行う際には、本ページの情報のみに依存しないでください。詳細については、免責事項をご確認ください。
コメント
0/400
コメントなし