Artificial Analysisの最新ベンチマークによると、Claude Opus 5はインテリジェンス指数で61点を獲得し、Fable 5の60点をわずかに上回りました。GPT-5.6 Solは59点、Kimi K3は57点です。
Opus 5はタスクあたりの平均が$2.03で、Fable 5の$2.75より26%低いです。このモデルはGDPval-AA v2およびAA-Briefcaseのナレッジワークテストで評価トップとなり、Claude Codeと組み合わせた際のプログラミング Agent指数でも1位にランクインしました。Terminal-Bench v2.1では89%を達成し、GPT-5.6 Solとほぼ同等でした。