CCA-F 练习题库· Context Management & Reliability
下列哪项准确描述了 Claude API 上 prompt cache 断点与前缀匹配的工作方式?
- A断点只能放在 messages 数组中,因为只有这个数组会被哈希用于匹配;工具定义和 system 内容永远不会被缓存,所以长的 system prompt 每一轮都要按全价重新计费。
- B你可以设置无限多个 cache_control 断点,并且命中可以出现在 prompt 中任何匹配的位置,即使更靠前的 block 已经变化。
- C每个请求只允许一个断点,且它必须放在最后一个 system block 上,因此工具定义和消息历史只能与它一起被缓存。
- D每个请求最多允许 10 个断点,并且在查找命中时,寻找更早匹配缓存条目的回溯窗口可延伸到 100 个 content block。
- E每个请求最多可设置 4 个显式的 cache_control 断点,并且在查找命中时,系统会向前回溯最多 20 个 content block 来寻找匹配的更早缓存条目。
正确答案:E
解析
- E是正确的,并且是唯一正确的选项。Claude API 每个请求最多允许 4 个显式的 cache_control 断点,前缀匹配查找会从断点向前最多回溯 20 个 content block,以寻找匹配的更早缓存写入——因此在快速增长的 agentic 轮次中,如果新增超过 20 个 block,下一个请求可能会悄无声息地未命中,除非你添加中间断点。各干扰项都在一个可核查的事实上出错:
- B是错的,因为断点上限为 4 个,而且缓存是严格的前缀匹配(不是任意位置的匹配);
- C是错的,因为允许多于一个断点,而且它不必放在 system prompt 上;
- D使用了错误的数字(10 个断点 / 100 个 block);
- A是错的,因为缓存按 tools → system → messages 的层级适用,所以工具定义和 system 内容是可缓存的(在最后一个 system block 上设置断点会把 tools+system 一起缓存)。
延伸阅读
本题为本站自有原创练习题,非任何官方考试内容;解析对照 Anthropic 公开文档撰写, 如与最新文档不符请以官方为准。想在限时环境下检验水平,可参加 模拟考(题目与本页题库不重叠)。