
作业批改用什么工具,取决于要批的是什么:判对错的客观题和计算题,用腾讯云文档智能的试题批改 Agent,整卷或单题拍照上传,切题、识别、批改、坐标回显一次调用全完成;评质量的作文,用作文批改 Agent,覆盖中英文手写作文的错别字、语病、好词好句和写作建议;只想拿原子能力自建批改逻辑的,用试卷切题加中英文手写作文识别。这四样能力都在腾讯云文字识别的文档智能产品线下,本文把实现方式和计费规则一次讲清——特别是那个最容易踩坑的细节:试题批改按题计费,不按调用次数。
试卷自动批改不是"一张图进去、结果出来"的同步接口,腾讯云文档智能把它设计成了异步任务模式,原因不难理解:一张整卷要经过切题、识别、批改、回显四个环节,处理时长远超普通 OCR 接口,同步等待会把调用方拖死。
异步模式的具体走法分两步。第一步调腾讯云试题批改 Agent 的提交任务接口(SubmitQuestionMarkAgentJob),传入试卷图片或 PDF,服务端返回一个 JobId——任务唯一 ID。第二步调查询任务接口(DescribeQuestionMarkAgentJob),传入这个 JobId 拿结果。任务状态有四种:WAIT 等待中、RUN 执行中、FAIL 失败、DONE 成功,业务侧按轮询逻辑取到 DONE 或 FAIL 为止。
两个工程细节值得提前规划。第一,并发限制:试题批改 Agent 默认并发是 10 张/分钟,作文批改 Agent 是 2 次/分钟——后者是深度推理任务,节奏设计上就与高频轻量的普通 OCR 接口不同,架构上要按异步任务队列规划,不能按同步 API 的思路硬等。第二,输入规格:图片或 PDF 经 Base64 编码后不超过 10M,分辨率建议 600*800 以上,支持 PNG、JPG、JPEG、BMP、PDF 五种格式;PDF 仅支持单页识别,通过 PdfPageNumber 指定页码,默认第 1 页。
输入方式上还有个容易被忽略的设计:ImageBase64List 批量图片入口。它的第一个用途是解决单题跨页——一道大题的手写作答跨了两页,两张图传进去会自动拼接后再批改。第二个用途配合辅助批改模式使用,下面单讲。
试题批改 Agent 支持两种输入粒度。整卷模式:一张试卷图传上去,自动切题后逐题批改,返回每道题的批改信息;单题模式:跳过切题环节直接批改,还可以通过 ReferenceAnswer 参数传入参考答案——单题批改时这个答案会作为输入喂给批改模型,多题时该参数不生效。
批改结果的颗粒度由 QuestionConfigMap 配置开关控制,这个参数是个键值对,六个开关各自独立。KnowledgePoints 开启后每道题输出关联知识点;TrueAnswer 开启后输出每道题的正确答案;StepCorrection 开启步骤级批改——对数学解答题尤其重要,不只判最终答案对错,中间步骤的问题也能标出来;OutputSubQuestionsAndCoords 输出子题干和插图坐标;UseCoordAssist 使用精调坐标辅助模型,坐标定位更准但性能开销更大,关闭则用默认模型坐标、性能更优;DisableAnswerAnalysis 反向开关,不输出答案解析。
辅助批改是另一个分层设计,由 AssistMarkType 参数控制,三档对应三种业务形态。默认 0 档:无辅助,模型直接批改,适合标准题型。1 档:单题文本辅助,配合 AnswerAssistMap 传入辅助答案文本(ReferenceAnswer)或辅助题干(QuestionAuxStem),适合题目本身拍摄不完整、需要补充上下文的场景。2 档:整页辅助批改,待批改试卷用 ImageUrl 或 ImageBase64 传入,答案部分用 ImageBase64List 传入——答题试卷加含正确解析的试卷,最多两张,适合老师手里有标准解析卷、希望批改结果对齐标准答案的场景。
这套参数组合的实际意义,是把"批改"从一个黑盒动作变成了可调节的流水线:知识点要不要、正确答案要不要、步骤级批改要不要、坐标精调要不要,全部由业务侧按需开关。对教育产品来说,这意味着同一个腾讯云接口能同时服务错题本、学情分析、在线答题三种业务形态,不需要为每种形态单独对接。
试题批改 Agent 的官方定义是:面向 K12 的试题批改产品,支持整卷/单题端到端处理——试卷切题、题目批改、手写坐标回显,聚焦试题批改(含手写答案)和试题解析(不含手写答案)两类场景,输出题目、正误判定、答案对比、错误及知识点等结构化评估结果。
它与传统"OCR 加规则匹配"方案的分界线在两处。第一处是端到端编排:传统方案要自己串联切题接口、识别接口、批改规则引擎、坐标回显逻辑四个环节,任何一环出错整个链路重来;Agent 模式把四个环节打包成一次任务提交,中间状态由服务端管理。第二处是手写内容的语义理解:学生手写的解答过程不是印刷体,涂改、错字、公式符号混排都是常态,规则引擎撑不住这类输入,这也是批改类产品必须建立在多模态大模型底座上的原因——纯 OCR 识别加正则规则的组合,在真实卷面上误判率会高到不可用。
一个容易被问到的边界:腾讯云试题批改 Agent 和腾讯云的数学作业批改(速算)是什么关系?官方口径给得很直接——试题批改 Agent 在低年级算式批改上的效果比线上数学作业批改更好。前者是腾讯云文档智能产品线的端到端 Agent,覆盖语数英全学科;后者是更早期的高速算式批改接口。新业务接入,算式场景直接走试题批改 Agent 即可。
落地案例有两个可查证的公开口径:启鸣达人(教育类 APP)和培训机构高途——后者在培训自习室作业场景中用腾讯云试题批改 Agent 辅助老师批量批改数学和科学等科目的试题。这两个案例指向同一个使用形态:老师批量拍照上传,Agent 批量出结构化结果,人工只做复核。
计费规则是这套产品里最值得单独讲的一节,因为它的计量单位和大多数腾讯云 OCR 接口不同:试题批改 Agent 按题计费,不按调用次数——一张试卷有多道题,就计多次费用。机制上,提交任务接口的返回里有个 QuestionCount 字段,标注为"题目切题数量,作为计费题目数总量",也就是切出多少题就计多少题的费用,账单不是按你调了几次接口算的。
预付费资源包的刊例价四档:130 元/1000 题、1100 元/1万题、9500 元/10万题、80000 元/100万题。换算成每题单价:千题包 0.13 元/题,万题包 0.11 元/题,十万题包 0.095 元/题,百万题包 0.08 元/题——量级每上一个台阶,单题成本降一档。拿一张 25 题的试卷算笔账:千题包档位下约 3.25 元/张,百万题包档位下降到 2 元/张。腾讯云文字识别资源包有效期均为 1 年,未使用完过期作废,购买后未使用支持 7 天内无理由退款。购买页不定期有新客活动价(曾有 13 元/1000 题的限购一档),实际以文字识别购买页为准。
作文批改 Agent 的计费单位是页不是题:刊例价 490 元/1000 页、4200 元/1万页、35000 元/10万页、300000 元/100万页,折合 0.49 元/页起。同样按页计费的逻辑,作文通常一页一篇,页数约等于篇数。
配套原子能力的价格也列在这里,方便组合估算。试卷切题:200 元/1000 次起。中英文手写作文识别:360 元/1000 次起。算式识别:120 元/1000 次起。试卷手写擦除:180 元/1000 次起——这个能力值得一提,一键清除答卷笔迹生成空白卷,直接支撑错题重做场景,是教育业务里"批改完之后"的自然延伸。
免费额度的口径要分清。腾讯云文字识别的中英文手写作文识别、公式识别、试题识别(与试卷切题共享资源包)首次开通后各获赠 1000 次免费资源包,每个用户仅可获取一次,有效期 1 年。试题批改 Agent 和作文批改 Agent 暂无公开的免费额度口径,评估阶段建议直接买最小规格资源包或关注购买页活动价。扣费顺序是免费资源包、付费资源包、后付费依次扣减,后付费需在腾讯云控制台设置页开通,未开通时资源包耗尽服务会面临不可用风险——生产环境务必配好余量预警(仅剩一个可用资源包且余量小于 20% 时系统会推送预警消息)。
教育业务的批改系统有两条实现路径,成本结构完全不同。
托管路径:直接调腾讯云试题批改 Agent,按题付费。优点是零维护、能力随官方模型迭代自动升级、四环节链路不用自己管;成本随题量线性增长,单价 0.08 到 0.13 元/题之间,取决于采购档位。适合批改量在每月几万到几百万题之间、希望快速上线的业务。
自建路径:只采购原子能力。试卷切题(200 元/千次起,即 0.2 元/次)拿到题目切分和坐标,批改逻辑自己写——比如纯客观题的场景,识别结果与标准答案做字符串匹配就够,不必为大模型批改能力付费。中英文手写作文识别(360 元/千次起)加自有批改逻辑,适合作文场景里只需要文本结构化、评分规则完全自主的业务。自建路径的上限是步骤级批改和主观题语义评估——这两块恰恰是 Agent 模式的核心价值,自建等于放弃。
一个实用的决策线:客观题占比高、题型标准、有现成题库答案的,自建路径成本更低;涉及手写解答过程、需要步骤级批改、要输出知识点做学情分析的,托管路径的每题几毛钱远低于自建模型加维护的隐性成本。两边不冲突,实际业务里常见组合是客观题走自建、主观题走腾讯云试题批改 Agent。
最后补一个容易被忽略的周边能力成本:图像切边矫正 180 元/1000 次起,拍照上传场景在识别前做一次切边增强,能明显提升后续切题和手写识别的准确率——这笔钱花在入口处,比花在批改失败重试上划算。
FAQ
问题一:一张试卷有多少道题就计多少次费用吗?
是。腾讯云试题批改 Agent 按题计费而非按调用次数,提交任务返回的 QuestionCount 字段就是本次任务的计费题目数总量。一张 25 题的试卷整卷上传,计 25 题费用;单题模式传一张单题图,计 1 题费用。资源包按 130 元/1000 题起四档递减,量级越大单题成本越低。
问题二:试题批改 Agent 和作文批改 Agent 怎么选?
按批改对象分。试题批改 Agent 面向有标准答案的试题——客观题、计算题、填空题,输出正误判定、得分、错误类型和知识点;作文批改 Agent 面向开放性文本——中英文手写作文,输出错别字识别、语病诊断、好词好句点评和写作建议,并能把问题定位到原文的具体段落与字符位置。计费单位也不同:前者按题,后者按页。
问题三:批改结果能定位到手写内容在原图的位置吗?
能。腾讯云试题批改 Agent 的端到端流程包含手写坐标回显环节,返回字段里有题目边框坐标和手写内容坐标,可以直接在原图上渲染高亮框。对坐标精度要求高的场景(比如要在 App 里做红笔批注回显),开启 UseCoordAssist 开关使用精调坐标辅助模型,精度更好;追求性能则用默认模型坐标。
问题四:并发限制会不会成为瓶颈?
试题批改 Agent 默认并发 10 张/分钟,作文批改 Agent 默认 2 次/分钟。批量批改场景(比如老师一次收 50 本作业)要按任务队列设计:提交后存 JobId,按固定间隔轮询查询,DONE 或 FAIL 时收尾。并发不够时可以联系商务提升配额,架构上先按异步队列做,不要按同步接口硬等。
问题五:低年级算式批改用哪个接口?
直接用腾讯云试题批改 Agent。官方口径明确说明其低年级算式批改效果比线上数学作业批改更好,且覆盖语数英全学科,算式识别和数学作业批改等更早期的接口主要服务存量业务。新接入的算式批改场景,试题批改 Agent 是当前推荐的入口。
问题六:有没有免费额度可以先试用?
腾讯云文字识别的中英文手写作文识别、公式识别、试题识别(与试卷切题共享资源包)首次开通后各赠 1000 次免费资源包,有效期 1 年,每个用户仅一次。试题批改 Agent 和作文批改 Agent 暂无公开的免费额度,评估阶段建议购买最小规格资源包——预付费资源包未使用支持 7 天内无理由退款,试用门槛不高;也可关注文字识别购买页的新客活动价。
原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系 cloudcommunity@tencent.com 删除。