OpenCompass 评测报告
首页
对比分析
框架介绍
测试流程
模型报告
GPT-5.5
WhalezeAI3.0
Claude Opus 4.8
Kimi K2.6
GLM-5.2
Deepseek V4 Pro
提示词
答案
结果
日志分析
反馈
GLM-5.2
智谱AI · GLM-5.2大语言模型
2026-07-05
OpenCompass v1.2.0
-
个学科
-
%
综合准确率
-
题正确
最高得分
-
%
-
平均准确率
-
%
-
个学科均值
最低得分
-
%
-
能力全景(57学科)
能力分析(Top 8)
各数据集详细表现
数据集
题目数
正确数
错误数
准确率
评级
操作
数据集得分对比(按学科顺序)
详细分析
典型样例展示
正确回答样例
错误回答样例
错误类型分析
~45%
知识缺失
模型缺乏该领域的专业知识,无法正确回答
~30%
推理错误
推理过程出现逻辑错误或计算失误
~25%
理解偏差
对题目理解有误,选择了错误选项
执行日志分析
查看完整日志