返回综合榜CAPABILITY PROFILE UNDERSTANDING THE RANK BEHIND THE SCORE
GLM-5.3 Flash
Z.ai · 2026-08-26 釋出 · 10/01 14:05 更新
綜合共識指數41.4綜合榜前 30 名之外
分類成績3/ 4 項分類
已有成績16項評測
上下文視窗—Token
各有所長,看得更清楚。
每項能力單獨計算。沒有足夠的實測,就留空。
不同分類的分數反映各自參照組中的排序支援,不能直接相加或用來比較不同能力的絕對高低。
綜合名次,有多穩定?
依次移除一項評測或一家機構、調整單項權重與誤差處理,觀察排名怎樣變化。
重新檢查資格後的名次27—41 名证据敏感
已完成的對照中均具備參評資格。保持原候選不變時為 27—41 名。這個範圍不是置信區間,也不包含從未公開的成績。
每一項成績,都有來處。
下面是該模型的公開彙總成績。展開可檢視執行配置與採用方式。
综合评测与体验4 項
编程3 項
推理5 項
知识1 項
专业办公2 項
视觉理解1 項
還有一些未知
缺失的評測不會記成零分。模型的名次會隨新證據變化,分數相近時不宜過度解讀細小差距。
瞭解計算方法 →