根據 PANews,7 月 29 日,Kimi 發布了 PerceptionBench,這是一個開源的多模態視覺感知基準,包含 3,000 個經人工驗證的問題,涵蓋 10 個原子能力,包括視覺關係、計數、屬性、深度、定位與幻覺檢測。在被評估的 16 個頂級多模態模型中,沒有任何一個整體準確率超過 60%。GPT-5.6-Sol 以 59.7% 位居第一,其後依序為 Kimi K3(58.5%)、Claude-Fable-5(57.2%)、Gemini-3.1-Pro(56.2%)以及 GPT-5.5(55.8%)。
免責聲明:本頁面資訊可能來自第三方來源,僅供參考,不代表 Gate 的立場或觀點,亦不構成任何財務、投資或法律建議。虛擬資產交易具有高風險,請勿僅依賴本頁資訊作出決策。詳情請參閱
免責聲明。