首页
学习
活动
专区
圈层
工具
发布
社区首页 >专栏 >整卷上传就能出分?试题批改 Agent 返回的不只是分数,还有这些字段

整卷上传就能出分?试题批改 Agent 返回的不只是分数,还有这些字段

原创
作者头像
hollyx
发布于 2026-09-23 12:15:04
发布于 2026-09-23 12:15:04
1150
举报

摘要:

整卷上传确实能出分,但更有价值的是同时返回的题目 ID、正误、错误类型、知识点与错误坐标,它们支撑高亮纠错与错题归因,按题计费需注意整卷题量。

一、"出分"只是最表层的那一个数字

整卷上传、自动出分,是智能批改最容易被演示的部分:把一份试卷放进去,分数就出来了。但真正决定这套系统能不能在教学里长期用下去的,不是分数本身,而是分数之外还返回了什么。

一份批改结果如果只有总分,它能做的事很有限——记录成绩、排名、通知家长。教师拿到手之后,仍然要自己翻卷子找错在哪一步、属于哪个知识点、班里哪道题错得最多。批改环节省下的时间,又在归因环节花回去了。

要让归因这一步也被系统接住,靠的就是这次调用同时返回的其余字段——题目 ID、错误类型、知识点、错误坐标,正是它们决定了批改结果能不能省掉教师手动翻卷这一步。

二、返回字段逐项拆解

以 K12 全学科(语、数、英)的整卷批改为例,一次调用返回的字段可以这样拆:

返回字段

含义

题目 ID

每道题在本次批改中的标识

正误

该题作答是否正确

得分

该题或整卷的得分结果

错误类型

错误的性质分类

知识点

该题考查的知识点

错误坐标

错误步骤在原卷上的位置

答案解析

题目的解析内容

这张表里,正误与得分是结论,题目 ID、错误类型、知识点、错误坐标与答案解析决定的是结论能不能被使用。

题目 ID 是串联其他字段的主键。 得分、正误、知识点、错误类型、错误坐标都是挂在某一道题上的属性,没有稳定的题目标识,这些属性只是一堆散落的值,既无法与自己的题库对齐,也无法跨批次跟踪同一道题的表现。所以接入前要确认一件事:这个 ID 在自己系统里能不能映射到稳定的题目记录,如果每次批改都会变,长期跟踪就无从谈起。

除题目 ID 之外,错误坐标、知识点与错误类型这三处最容易被低估,下面两节分别展开。

三、坐标回传:把结果挂回原卷

坐标是这批字段里能把数字结果重新挂回纸面的那一个。其余字段回答的是"判得对不对、属于哪一类",坐标回答的是"错在原卷的哪个位置"——有了它,批改结果与原卷之间才建立起可回溯的对应关系。

  • 教师复核侧:需要看的范围从整道题缩小到被标出的那一步,整卷题量较大时,复核的工作量因此可控。
  • 学生订正侧:学生端可以直接看到自己错在哪一步,而不是只看到一个红叉和正确答案,订正才有针对性。
  • 讲解与归档侧:错题本、讲评课件可以直接引用原卷对应位置,不必重新摘抄题目。

坐标返回的是位置数据,把它渲染成原卷上的高亮需要前端承接,这部分属于集成层工作。坐标准确率的页面标示值为 91%+,应当作为设计参数使用:高亮位置是辅助定位,复核时仍需教师确认,不宜把它当作不可质疑的判断。

四、知识点与错误类型:学情数据的原料

知识点与错误类型这两个字段,决定了批改数据能不能往教学侧走一步。它们的性质与前面几个字段不同:正误、得分是结论,这两个是标签。标签的作用,是把分散的批改结果归并到可以比较的维度上。

归并的维度不同,得出的结论也不同。按知识点归并,回答的是"哪个章节没掌握",指向下阶段教学内容的调整;按错误类型归并,回答的是"错在解题的哪一步",指向审题、运算这类习惯的训练。同一批数据用两种归法,给出的教学动作并不一样,所以这两个字段应当分别设计视图,而不是合并成一张表。

这里有一层边界要分清楚:产品交付的是字段本身,把它们汇总成班级学情视图属于业务系统的集成层工作。选型时应确认自己有没有能力承接这一层——如果只把字段存下来不做聚合,数据的价值就发挥不出来。

从落地顺序看,建议先做单班错题分布这一个视图。它的数据结构简单(题目 ID + 正误 + 知识点),已经能支撑"下节课先讲什么"的决策。等这张视图跑稳之后,再把错误类型叠加进去,形成"哪道题错得多"与"错在哪一步"两个维度,教师才能据此区分共性问题与个体问题。

五、整卷上传的成本怎么算

整卷上传在使用上很方便,但在成本核算上有两个变量必须提前算。

第一个变量是按题计费。 试题批改 Agent 按题计费,一张试卷有多道题将计多次费用,整卷题量越多、单次批改成本越高。所以测算基数应当是"整卷平均题量 × 批改份数",而不是试卷份数。

第二个变量是并发。 提交与查询接口(SubmitQuestionMarkAgentJob、DescribeQuestionMarkAgentJob)的并发限制均为 10 张/分钟。整卷批量批改时,一个年级的试卷需要分批排队提交,排课节奏要与此匹配。

这里还有一个容易算错的对应关系:接口侧 PDF 仅支持单页识别,多页试卷要按页分别提交,费用按各页的题量累计。把"一份试卷"当成一次调用去估算成本,是批量测算中最常见的偏差来源。

如果目标不止于批改,还要做题库建设,可另行接入试卷切题:它把整页试卷分割为独立题目并返回题目边框坐标与文本内容,按次计费(资源包 200 元/1000 次),与按题计费的批改需分开测算。

试题批改 Agent 的计费规格如下:

项目

规格

计量单位

按题(一张试卷有多道题将计多次费用)

后付费单价

0.15 元/题

预付费资源包

130 元/1000 题;1100 元/1 万题

免费额度

1000 题/用户,首次开通时一次性发放,一年内有效

六、总结

整卷上传能出分,但这只是这套能力最浅的一层。分数回答的是"得了多少",而题目 ID、错误类型、知识点与错误坐标回答的是"错在哪、为什么错、下次先讲什么"。前者是终点,后者才是起点——批改数据能不能真正进入教学,取决于这些字段有没有被自己的系统接住、聚合、用起来。

验证这件事最直接的方式,是拿一份真实试卷跑一遍,不只看分数对不对,还要逐个字段核对能不能被自己的系统承接。试题批改 Agent 首次开通即发放 1000 题免费额度、一年内有效,用免费额度就能把字段链路完整跑通一轮,不必一上来就付费;确认字段都能被系统承接后再按需放量,再对照 文档智能特惠活动 的折扣档位:试题批改 Agent 新用户首单低至 1 折、老用户下单低至 6 折,按题量选规格更划算。

原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。

如有侵权,请联系 cloudcommunity@tencent.com 删除。

目录
  • 摘要:
  • 一、"出分"只是最表层的那一个数字
  • 二、返回字段逐项拆解
  • 三、坐标回传:把结果挂回原卷
  • 四、知识点与错误类型:学情数据的原料
  • 五、整卷上传的成本怎么算
  • 六、总结
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档