人工智能評測:大模型能力差異顯著
2026-08-05 13:52:22
幣界網消息,人工智能評測機構 artificial analysis 公布了 API 正確率排行榜,測試同一開源模型在不同雲服務供應商下的能力保留情況。首批測試包括 glm-5.2、gpt-oss-120b 和 deepseek v4 pro,覆蓋44個 API 端點。結果顯示,glm-5.2 最差的端點僅有52%的能力保留,gpt-oss-120b 得分在70%至101%之間,而 deepseek v4 pro 在9家服務供應商中均保持在97%至107%之間,官方 API 得分最高。差距主要來源於量化、輸出長度、推理配置和工具調用處理。
來源:互聯網
本內容只為提供市場資訊,不構成投資建議。
關注WalletJYS官方帳號,及時關注最新動態






