Claude Code 学习站

CCA-F 练习题库· Tool Design & MCP Integration

某抽取流水线处理技术手册。有一本手册列出了两个相互冲突的电池容量:一个在正文中,另一个不同的值在详细规格表里。历史数据显示规格表有 90% 的时候是正确的。抽取 schema 应该如何处理这种情况?

  1. A只要正文与规格表不一致就中止流水线,把该手册转入人工修正队列,人工修正之后才做抽取。
  2. B保留单值 schema,提示模型权衡两个候选值,只输出它判断为最可能正确的那一个。
  3. C硬编码一条优先级规则,始终抽取规格表中的值,因为该表历史上有 90% 的时候是对的。
  4. D把该字段改为记录所有相互冲突的值及其来源位置,保留 provenance 以供下游做核对调和。

正确答案:D

解析

  • D正确。当抽取来源在两个位置之间存在真实冲突时(自由文本 vs. 规格表),schema 应当被放宽,以同时记录所有冲突值及其来源位置,保留 provenance,使下游步骤或人工能够在证据齐全的情况下做调和,而不是把证据丢掉。干扰项各有明显缺陷:
  • C(“始终使用表格”)硬编码了一条规则,把已知的 10% 表格错误率固化了进去,并悄悄丢弃了正文中的值;
  • B强行给出单一值,毁掉了冲突证据,即便模型平均而言猜对了也不留下审计线索;
  • A(中止并标记)对自动化流水线而言不切实际,并且回避了真正的 schema 设计问题。因为题目问的正是抽取 schema 应如何对这种歧义建模,所以只有 D 直接回答了 schema 设计。

延伸阅读

本题为本站自有原创练习题,非任何官方考试内容;解析对照 Anthropic 公开文档撰写, 如与最新文档不符请以官方为准。想在限时环境下检验水平,可参加 模拟考(题目与本页题库不重叠)。