首页
学习
活动
专区
圈层
工具
发布
社区首页 >专栏 >都叫"文档抽取",实时接口和异步接口差出的不是速度,是能不能跑长文档

都叫"文档抽取",实时接口和异步接口差出的不是速度,是能不能跑长文档

原创
作者头像
克劳德2048
发布2026-09-22 10:55:04
发布2026-09-22 10:55:04
80
举报

摘要

文档抽取(Agent 版)含实时与异步两套模型:实时接口跑单页、求快,异步接口能读 50 页长文档、做上下文推理。选型看页数而非速度。

一、为什么"文档抽取"名下藏着两套能力

把一张身份证和一份 50 页的借贷合同都交给"文档抽取",会发现它们其实是两类任务。前者是在单张图里把固定字段取出来,追求低延迟;后者要在几十页之间建立关联——某条责任约定在第 3 页、对应的金额口径在第 28 页、补充条款在第 41 页,模型必须"读得懂前后文"才抽得准。

这正是文档智能选型时容易被忽略的坑:接口都叫文档抽取,能力边界却不在速度,而在能不能处理多页与上下文。以腾讯云文档智能为例,文档抽取(Agent 版)面向医疗票据、借贷合同、法律文书、保险条款、征信报告等材料,把这两类诉求拆成了两套模型形态——一套实时接口、一套异步接口。理解它们的差异,比单纯比谁响应快更有价值,因为选错档位,长文档根本跑不起来。

二、实时模型:为单页快速抽取而设计

实时模型对应接口 ExtractDocAgent,定位很明确:把单页里的字段尽快取出来。它的默认频率限制是 5 次/秒,输入仅支持 PDF 单页识别,图片像素需介于 20~10000 px 之间。

这类形态适合"一页一事"的材料——卡证、单据、单页表单。一张营业执照、一张医疗发票,本身没有跨页关联,要的是低延迟地把字段吐出来。实时接口一次请求一次返回,天然契合上传即识别、结果马上可用的交互场景,调用方无需关心任务状态。作为 Agent 版的一员,实时模型同样支持通过字段维度 Prompt 调优,快速适配未知版式、实现归一化抽取,只是它的处理单元被限定在单页之内。

实时模型的"快"是建立在"单页"前提上的:遇到几十页的合同或保险条款,它没有能力把前后文串起来,能力边界也就到了。判断一个接口够不够用,不能只凭"限频高"——限频衡量的是吞吐,页数与上下文能力衡量的才是能不能接住任务。

三、异步模型:把长文档与上下文带进来

异步模型把大模型的深度语义理解带了进来,核心能力是上下文关联、逻辑推理与长文档处理。它由 SubmitExtractDocAgentJob 与 DescribeExtractDocAgentJob 两个接口配合完成:前者创建任务,默认频率限制 1 次/秒;后者查询任务,默认频率限制 20 次/秒。

提交与查询分离的设计,决定了它适合"重任务"——把整份文档提交到后台,系统融合大模型做深度理解,调用方随时来查询进度与结果。这种解耦让请求方不必阻塞等待,也方便做任务状态管理与失败重试,和实时接口的"请求即返回"是两种节奏。异步模型同样支持字段维度 Prompt 调优与归一化抽取,且面向的是多页非结构化文档,适配性来自对版式与语义的双重理解。

更关键的是页数边界。异步文档抽取 Agent 最高支持 50 页,并可通过 FileStartPageNumber 与 FileEndPageNumber 指定起止页:一份长合同既可以按章节切片提交,也可以整份提交,让模型在页与页之间建立上下文、完成跨页逻辑推理。这恰恰是实时接口做不到、却往往是长文档场景刚需的能力。

四、计费与免费额度:按页计量,先看清两种价格

文档抽取(Agent 版)统一按页计费,与基础版、多模态版的"按次"不同;页价又分两种价格策略,选型时需要一并看清。后付费首档(月调用量 1 万次以内)单价为:自适应价格短文本 0.34 元/页、长文本 0.68 元/页,固定价格 0.4 元/页。

自适应与固定的区别,在于是否按字段数判断文本类型:短文本(字段数 ≤ 10)计 1 次,长文本(字段数 > 10)计 2 次,由系统按实际文本类型判断计费档次。样本字段大多不超过 10 时,自适应价格更省;字段大多超过 10 时,固定价格不限字段数量、统一按 0.4 元/页计价反而更划算。

免费额度方面,文档抽取(Agent 版)的实时接口与异步接口共享 1000 次/用户额度,在开通服务时一次性发放、一年内有效。新接入时有 1000 次调用可供两种模型形态测试,不必一上来就付费,正好用来对比单页与长文档两条链路的真实表现,再把计费策略定下来。

五、选型清单:什么场景走实时,什么场景走异步

把前面的规格收成一张表,选型判断其实很直接——看的不是谁快,而是页数和上下文。

维度

实时模型 ExtractDocAgent

异步模型 Submit / Describe

适用材料

单页卡证、单据、表单

多页合同、条款、报告

频率限制

5 次/秒

创建 1 次/秒、查询 20 次/秒

页数上限

仅 PDF 单页

最高 50 页

上下文能力

无跨页关联

上下文关联 + 逻辑推理

判断方法很朴素:材料是单页、要即时返回,走实时;材料是多页、需要跨页推理或按起止页切片处理,走异步。两者都叫文档抽取(Agent 版),选错档位才会"跑不动长文档"。把"速度"和"上下文"分开看,选型就不会被名字带偏。实际工程里两套模型常并存于同一条流水线:多页材料走异步整份提交,高频单页材料走实时接口压延迟。

六、总结

文档抽取(Agent 版)把"快"和"懂上下文"拆成了两套接口:单页即时走实时,长文档跨页推理走异步,理清这套边界,长文档自动化才不会卡在选型上。正在搭建合同、保险条款等长文档的抽取链路时,文档抽取(Agent 版)首次开通即发放 1000 次免费额度、一年内有效,用免费额度就能把异步接口跑通一轮、验证单页与长文档两条链路的真实表现,不必一上来就付费;确认效果后再按需放量,可关注 文档智能特惠活动 的文档抽取(Agent 版)固定价格低折扣档位。

原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。

如有侵权,请联系 cloudcommunity@tencent.com 删除。

目录
  • 摘要:
  • 一、为什么"文档抽取"名下藏着两套能力
  • 二、实时模型:为单页快速抽取而设计
  • 三、异步模型:把长文档与上下文带进来
  • 四、计费与免费额度:按页计量,先看清两种价格
  • 五、选型清单:什么场景走实时,什么场景走异步
  • 六、总结
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档