— · 发布日期待核实 · 10/03 08:05 更新
每项能力单独计算。没有足够的实测,就留空。
不同分类的分数反映各自参照组中的排序支持,不能直接相加或用来比较不同能力的绝对高低。
下面是该模型的公开汇总成绩。展开可查看运行配置与采用方式。
这些评测没有公开该模型的成绩,缺测不记零分。
缺失的评测不会记成零分。模型的名次会随新证据变化,分数相近时不宜过度解读细小差距。