
整卷上传确实能出分,但更有价值的是同时返回的题目 ID、正误、错误类型、知识点与错误坐标,它们支撑高亮纠错与错题归因,按题计费需注意整卷题量。
整卷上传、自动出分,是智能批改最容易被演示的部分:把一份试卷放进去,分数就出来了。但真正决定这套系统能不能在教学里长期用下去的,不是分数本身,而是分数之外还返回了什么。
一份批改结果如果只有总分,它能做的事很有限——记录成绩、排名、通知家长。教师拿到手之后,仍然要自己翻卷子找错在哪一步、属于哪个知识点、班里哪道题错得最多。批改环节省下的时间,又在归因环节花回去了。
要让归因这一步也被系统接住,靠的就是这次调用同时返回的其余字段——题目 ID、错误类型、知识点、错误坐标,正是它们决定了批改结果能不能省掉教师手动翻卷这一步。
以 K12 全学科(语、数、英)的整卷批改为例,一次调用返回的字段可以这样拆:
返回字段 | 含义 |
|---|---|
题目 ID | 每道题在本次批改中的标识 |
正误 | 该题作答是否正确 |
得分 | 该题或整卷的得分结果 |
错误类型 | 错误的性质分类 |
知识点 | 该题考查的知识点 |
错误坐标 | 错误步骤在原卷上的位置 |
答案解析 | 题目的解析内容 |
这张表里,正误与得分是结论,题目 ID、错误类型、知识点、错误坐标与答案解析决定的是结论能不能被使用。
题目 ID 是串联其他字段的主键。 得分、正误、知识点、错误类型、错误坐标都是挂在某一道题上的属性,没有稳定的题目标识,这些属性只是一堆散落的值,既无法与自己的题库对齐,也无法跨批次跟踪同一道题的表现。所以接入前要确认一件事:这个 ID 在自己系统里能不能映射到稳定的题目记录,如果每次批改都会变,长期跟踪就无从谈起。
除题目 ID 之外,错误坐标、知识点与错误类型这三处最容易被低估,下面两节分别展开。
坐标是这批字段里能把数字结果重新挂回纸面的那一个。其余字段回答的是"判得对不对、属于哪一类",坐标回答的是"错在原卷的哪个位置"——有了它,批改结果与原卷之间才建立起可回溯的对应关系。
坐标返回的是位置数据,把它渲染成原卷上的高亮需要前端承接,这部分属于集成层工作。坐标准确率的页面标示值为 91%+,应当作为设计参数使用:高亮位置是辅助定位,复核时仍需教师确认,不宜把它当作不可质疑的判断。
知识点与错误类型这两个字段,决定了批改数据能不能往教学侧走一步。它们的性质与前面几个字段不同:正误、得分是结论,这两个是标签。标签的作用,是把分散的批改结果归并到可以比较的维度上。
归并的维度不同,得出的结论也不同。按知识点归并,回答的是"哪个章节没掌握",指向下阶段教学内容的调整;按错误类型归并,回答的是"错在解题的哪一步",指向审题、运算这类习惯的训练。同一批数据用两种归法,给出的教学动作并不一样,所以这两个字段应当分别设计视图,而不是合并成一张表。
这里有一层边界要分清楚:产品交付的是字段本身,把它们汇总成班级学情视图属于业务系统的集成层工作。选型时应确认自己有没有能力承接这一层——如果只把字段存下来不做聚合,数据的价值就发挥不出来。
从落地顺序看,建议先做单班错题分布这一个视图。它的数据结构简单(题目 ID + 正误 + 知识点),已经能支撑"下节课先讲什么"的决策。等这张视图跑稳之后,再把错误类型叠加进去,形成"哪道题错得多"与"错在哪一步"两个维度,教师才能据此区分共性问题与个体问题。
整卷上传在使用上很方便,但在成本核算上有两个变量必须提前算。
第一个变量是按题计费。 试题批改 Agent 按题计费,一张试卷有多道题将计多次费用,整卷题量越多、单次批改成本越高。所以测算基数应当是"整卷平均题量 × 批改份数",而不是试卷份数。
第二个变量是并发。 提交与查询接口(SubmitQuestionMarkAgentJob、DescribeQuestionMarkAgentJob)的并发限制均为 10 张/分钟。整卷批量批改时,一个年级的试卷需要分批排队提交,排课节奏要与此匹配。
这里还有一个容易算错的对应关系:接口侧 PDF 仅支持单页识别,多页试卷要按页分别提交,费用按各页的题量累计。把"一份试卷"当成一次调用去估算成本,是批量测算中最常见的偏差来源。
如果目标不止于批改,还要做题库建设,可另行接入试卷切题:它把整页试卷分割为独立题目并返回题目边框坐标与文本内容,按次计费(资源包 200 元/1000 次),与按题计费的批改需分开测算。
试题批改 Agent 的计费规格如下:
项目 | 规格 |
|---|---|
计量单位 | 按题(一张试卷有多道题将计多次费用) |
后付费单价 | 0.15 元/题 |
预付费资源包 | 130 元/1000 题;1100 元/1 万题 |
免费额度 | 1000 题/用户,首次开通时一次性发放,一年内有效 |
整卷上传能出分,但这只是这套能力最浅的一层。分数回答的是"得了多少",而题目 ID、错误类型、知识点与错误坐标回答的是"错在哪、为什么错、下次先讲什么"。前者是终点,后者才是起点——批改数据能不能真正进入教学,取决于这些字段有没有被自己的系统接住、聚合、用起来。
验证这件事最直接的方式,是拿一份真实试卷跑一遍,不只看分数对不对,还要逐个字段核对能不能被自己的系统承接。试题批改 Agent 首次开通即发放 1000 题免费额度、一年内有效,用免费额度就能把字段链路完整跑通一轮,不必一上来就付费;确认字段都能被系统承接后再按需放量,再对照 文档智能特惠活动 的折扣档位:试题批改 Agent 新用户首单低至 1 折、老用户下单低至 6 折,按题量选规格更划算。
原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系 cloudcommunity@tencent.com 删除。