跳到正文
返回综合榜

DeepSeek V4 Pro Preview

DeepSeek · 2026-04-24 釋出 · 10/01 14:05 更新

綜合共識指數35.4綜合榜前 30 名之外
分類成績3/ 4 項分類
已有成績14項評測
上下文視窗—Token
API 每百萬 Token$0.43 / $0.87快取 $0.00363約 NT$13.7 / NT$27.4廠商官方價格
CAPABILITY PROFILE

各有所長,看得更清楚。

每項能力單獨計算。沒有足夠的實測,就留空。

不同分類的分數反映各自參照組中的排序支援,不能直接相加或用來比較不同能力的絕對高低。

UNDERSTANDING THE RANK

綜合名次,有多穩定?

依次移除一項評測或一家機構、調整單項權重與誤差處理,觀察排名怎樣變化。

重新檢查資格後的名次40—49 名证据敏感

已完成的對照中均具備參評資格。保持原候選不變時為 40—49 名。這個範圍不是置信區間,也不包含從未公開的成績。

BEHIND THE SCORE

每一項成績,都有來處。

下面是該模型的公開彙總成績。展開可檢視執行配置與採用方式。

综合评测与体验4 項

编程2 項

推理5 項

知识2 項

专业办公1 項

沒有測到的計分評測

這些評測沒有公開該模型的成績,缺測不記零分。

還有一些未知

缺失的評測不會記成零分。模型的名次會隨新證據變化,分數相近時不宜過度解讀細小差距。

瞭解計算方法 →