返回综合榜CAPABILITY PROFILE UNDERSTANDING THE RANK BEHIND THE SCORE
GLM-5.3
开源权重 ↗67.0综合榜第 20 名
分类成绩4/ 4 项分类
已有成绩17项评测
上下文窗口—Token
API 输入 / 输出 · 每百万 Token¥9.39 / ¥29.5
各有所长,看得更清楚。
每项能力单独计算。没有足够的实测,就留空。
综合名次,有多稳定?
依次移除一项评测或一家机构、调整单项权重与误差处理,观察排名怎样变化。
14—23 名证据敏感
已完成的对照中均具备参评资格。保持原候选不变时为 14—23 名。这个范围不是置信区间,也不包含从未公开的成绩。
每一项成绩,都有来处。
下面是该模型的公开汇总成绩。展开可查看运行配置与采用方式。
综合评测与体验6 项
编程3 项
推理5 项
知识2 项
专业办公1 项
没有测到的计分评测
还有一些未知
缺失的评测不会记成零分。模型的名次会随新证据变化,分数相近时不宜过度解读细小差距。
了解计算方法 →