文档智能与 OCR 进阶

共 17 题
#

1. 复杂版面(表格/多栏/公式)文档的结构化抽取如何保证保真

A 仅文字 WER
B 结构级指标(TEDS、单元格准确率、阅读顺序) ✓ 正确答案
C 仅图像分辨率
D 无评测
#

2. 文档抽取结果的字段级置信度如何输出供人工复核

A 仅展示
B 替代人工
C 无用途
D 决定字段是否进入人工复核并按其排序 ✓ 正确答案
#

3. 人工复核工作台的字段级标错如何回流为评测集,并驱动 Prompt 与模型版本迭代

A 仅存档
B 构建评测集并驱动 Prompt 与模型迭代 ✓ 正确答案
C 无意义
D 只用于展示
#

4. 复核标注数据的采样与脱敏如何做,既满足评估需要又符合隐私合规

A 只采样
B 完全删除
C 原样保留
D 去标识化保留结构特征,满足评估与合规 ✓ 正确答案
#

5. 多模态大模型(VLM)做文档理解相比传统 OCR+NLP 流水线的优势

A 成本更低
B 端到端语义理解复杂版面,无需拆分环节 ✓ 正确答案
C 精度必然更高
D 更可解释
#

6. 如何用 JSON Schema/函数调用约束 VLM 抽取输出的结构化,字段级校验与重试如何设计

A 不约束
B 只靠运气
C 用 JSON Schema/函数调用约束,加字段级校验与定向重试 ✓ 正确答案
D 只校验类型
#

7. 长文档(百页 PDF)用 VLM 理解时的分页策略与跨页上下文

A 把每页孤立处理
B 跨页关联表头与引用,分层聚合理解 ✓ 正确答案
C 丢弃跨页内容
D 只处理单页
#

8. 扫描件低质量图像对 VLM 抽取准确率的影响与增强手段

A 原样处理
B 忽略质量
C 提高模型参数
D 图像增强预处理(去噪校正超分)并分块保细节 ✓ 正确答案
#

9. OCR 版面理解中表格、公式与阅读顺序的还原误差应如何评估,结构化输出如何与版面位置对应?

A 仅文本
B 随机对应
C 每个元素带坐标框,与版面坐标绑定 ✓ 正确答案
D 无位置信息
#

10. 文档解析的批处理与成本,OCR/VLM 的并发、队列、缓存与按页计费的成本优化?

A 提高速度
B 不加使用
C 复用相同/相似文档结果,减少重复计算与计费 ✓ 正确答案
D 只存日志
#

11. VLM 与传统布局分析模型(LayoutLM)如何互补

A 仅 VLM
B 仅视觉
C 随机
D LayoutLM 类模型,VLM 做复杂版面兜底 ✓ 正确答案
#

12. 文档解析选型(传统布局模型 vs VLM)应依据哪些任务指标(表格还原率、字段准确率、成本与延迟)?

A 传统布局模型(成本低精度高),VLM 兜底复杂场景 ✓ 正确答案
B 一律 VLM
C 随机
D 只看成本
#

13. 文档问答的长文档切块策略如何与问题类型匹配(跨页表格、连续段落、术语定义)?

A 按固定字长切块
B 丢弃表格
C 按表格边界切块并保留跨页表头 ✓ 正确答案
D 只切单页
#

14. 文档抽取评测集应如何标注字段级正确性并计算准确率,抽检与线上回流如何组织?

A 只按文档整体
B 只算缺失
C 随机
D 正确字段数除以总字段数,区分错误类型 ✓ 正确答案
#

15. 文档处理管道中敏感信息(身份证号、金额、密钥)的检测与脱敏应在哪个环节完成,脱敏后如何保证下游检索可用?

A 解析后、入库与检索前 ✓ 正确答案
B 检索之后
C 展示时
D 永不脱敏
#

16. 文档解析流水线(预处理、OCR、结构化)各环节的误差如何传递,质量门禁应设在哪些节点?

A 仅输入
B 仅最终输出
C 无门禁
D 预处理、OCR、结构化各关键节点,并设端到端门禁 ✓ 正确答案
#

17. 文档解析的失败处理,低质量页面的重试、置信度门槛、人工兜底与重解析流程?

A 进入人工复核队列,并支持修正后重解析 ✓ 正确答案
B 直接忽略
C 无限重试
D 默认正确