AI 分析能力测试:Claude Opus 5通过率仅54%
2026-08-12 15:01:28
幣界網消息,人工智能分析能力測試aa-analystagent近日推出,測試共有80道題,每道題要求模型獨立做5遍,只有5次全部答對才算通過。結果顯示,Claude Opus以54%的通過率位居第一,GPT-5.5排第二,通過率爲50%,而Claude Fable爲49%。開放權重模型中表現最佳的是Kimi K3,達到39%。如果只看每次作答的平均正確率,GPT-5.5最高,達到66%。但在要求同一道題連續做對5次後,其通過率降至50%。測試分析還指出,AI模型常見的問題是對題目的理解錯誤,導致後續作答方向偏差。
利好 0
利空 0
來源:互聯網
本內容只為提供市場資訊,不構成投資建議。