政策文本评价新建测评

政策文本测评

在相同题目和材料条件下,对不同模型输出进行结构化评价,并对待测政策文本形成逐句审校和修改建议。

主要功能

支持模型间比较与同一文本版本迭代分析
01

横向测评

将待测政策文本与多个通用大模型在同题、同材料条件下进行比较,形成综合得分和八维分项结果。

当前页面可直接使用
02

纵向测评

比较同一待测政策文本的上一版本与当前版本,识别总分、分项能力和具体问题的变化。

当前页面可直接使用
03

待测政策文本审校

对当前待测文本逐句定位问题,以批注形式给出风险等级、问题说明、修改建议和建议改写。

完成测评后进入
04

人工复核

同行、政府部门或行业专家可对各维度进行人工修正,保留自动初评与人工复核记录。

完成横向测评后进入
05

测评结果导出

支持导出Word报告、CSV评分数据、审校清单和版本变化结果,并可打印保存为PDF。

完成测评后进入

测评任务

选择政策领域,填写同一评价题目

评价对象

可粘贴文本,也可上传原文;上传文件优先
待测政策文本同步生成原文审校与修改建议
1
0 字
DeepSeek通用模型比较对象
2
0 字
Kimi通用模型比较对象
3
0 字
GLM5.3通用模型比较对象
4
0 字
Qwen3.7通用模型比较对象
5
0 字
HY3通用模型比较对象
6
0 字

纵向测评:文本版本迭代分析

上一版本 → 当前版本

适用于同一政策文本修改前后的效果比较。两版文本采用同一套评价规则,重点观察哪些维度得到改善、哪些问题仍需继续修改。

上一版本作为比较基准
当前版本重点评价对象