Agent 的引用溯源机制:当模型输出自带来源标注
构建一个基于文档回答的 Agent 时最让人头疼的问题不是 Agent 答不出来而是它答出来的内容你没法验证。用户问根据这份合同违约金是多少Agent 返回了一个数字。用户信了。但你怎么知道它没看错条款你说我让它引用原文但靠 Prompt 要求模型输出引用结果要么是模型自己编造了原文citation hallucination要么是引用格式不统一前端没法渲染。这个问题在 RAG 应用中尤其突出。当 Agent 从多个文档中检索信息再组织成回答时用户看到的是模型整理后的文本而不是原始证据。你没法判断这个结论是来自文档还是模型自己推断的。企业级场景下这种不可验证性直接决定了 Agent 能不能上线。Anthropic 的 Citations 特性解决的就是这个具体问题让模型在回答时自动标注每条结论来自哪个文档的哪个位置并且返回原文片段。关键在于这不是靠 Prompt 提示模型请引用原文而是 API 层面的结构化机制——模型输出时API 自动解析出引用关系返回结构化的 citation 对象包含被引用的原文文本和文档中的精确位置。引用机制的技术拆解先看最基础的使用方式。在 API 请求中把文档以document类型的内容块传入并在文档上设置citations.enabled: trueresponse client.messages.create( modelclaude-opus-5, max_tokens1024, messages[ { role: user, content: [ { type: document, source: { type: text, media_type: text/plain, data: The grass is green. The sky is blue., }, title: My Document, context: This is a trustworthy document., citations: {enabled: True}, }, {type: text, text: What color is the grass and sky?}, ], } ], )关键点在于citations.enabled是设置在文档上的不是全局参数。这意味着你可以同时传入需要引用的文档和不需要引用的文档但当前版本要求同一个请求中要么全部启用要么全部禁用。响应结构是理解这个特性的核心。模型返回的content不再是一个完整的文本块而是被拆分成多个文本块每块可能附带一组citations{ content: [ {type: text, text: According to the document, }, { type: text, text: the grass is green, citations: [ { type: char_location, cited_text: The grass is green., document_index: 0, document_title: Example Document, start_char_index: 0, end_char_index: 20, } ], }, {type: text, text: and }, { type: text, text: the sky is blue, citations: [ { type: char_location, cited_text: The sky is blue., document_index: 0, document_title: Example Document, start_char_index: 20, end_char_index: 36, } ], } ] }每个citation对象包含被引用的原文片段cited_text、所属文档的索引document_index、文档标题document_title以及根据文档类型不同的位置信息。对于纯文本文档位置信息是字符索引范围对于 PDF是页码范围对于自定义内容文档是内容块索引范围。cited_text不计入输出 Token——这是需要特别注意的工程细节。如果你的应用之前靠 Prompt 让模型输出引用每次引用都会消耗输出 Token 和对应的费用。使用 Citations 特性后cited_text由 API 直接从文档中提取不产生额外 Token 消耗。三种文档类型的选择策略Anthropic 支持三种文档类型每种有不同的分块策略和引用格式文档类型分块方式引用格式适用场景纯文本按句子分块字符索引范围标准文档、文章PDF按句子分块页码范围扫描件、正式报告自定义内容不额外分块内容块索引范围列表、转录、RAG 分块纯文本和 PDF 文档会被自动按句子分块模型可以引用单个句子或多个连续句子。自定义内容文档则让你自己控制分块粒度——你把内容按你的逻辑切好模型直接引用你提供的块。这个选择对 RAG 场景有直接影响。如果你的 RAG 系统已经对文档做了分块处理每个块是一个独立的检索单元那么使用自定义内容文档类型把每个 RAG 块作为一个独立的内容块传入可以避免 API 再次分块带来的不确定性。反之如果想让 API 自动处理分块使用纯文本类型即可。流式场景下的引用处理Citations 在流式响应中以citations_delta事件类型到达。当使用 Server-Sent Events 流式接收响应时引用数据会以独立的 delta 事件发送event: content_block_delta data: {type: content_block_delta, index: 0, delta: {type: citations_delta, citation: { type: char_location, cited_text: ..., document_index: 0, }}}这意味着前端需要处理两种 delta 类型text_delta用于渲染文本citations_delta用于在对应文本块上附加引用信息。如果前端已经在处理流式文本渲染需要额外处理citations_delta事件来更新引用标注。与 Prompt Caching 的配合Citations 和 Prompt Caching 可以同时使用。文档内容可以被缓存而引用结果不会缓存——每次请求都会重新生成引用。在文档上设置cache_control即可response client.messages.create( modelclaude-opus-5, max_tokens1024, messages[ { role: user, content: [ { type: document, source: { type: text, media_type: text/plain, data: long_document, }, citations: {enabled: True}, cache_control: {type: ephemeral}, }, {type: text, text: What does this document say?}, ], } ], )对于长度超过缓存阈值的文档这个组合能显著降低重复请求的输入 Token 成本。需要注意引用结果本身不缓存但文档内容是缓存的有效部分。重要边界与结构化输出的不兼容Citations 不能和结构化输出Structured Outputs一起使用。如果在文档上启用citations.enabled同时在请求中设置了output_config.format参数API 会返回 400 错误。原因是引用需要在文本输出中穿插 citation 块这与严格 JSON Schema 约束的结构化输出不兼容。这个限制在实际工程中意味着如果你的 Agent 需要同时做两件事——从文档中提取信息需要引用和输出结构化数据需要结构化输出——你需要拆成两轮调用。第一轮用 Citations 获取带引用的文本回答第二轮用结构化输出提取关键字段。或者放弃引用直接用结构化输出提取数据。工程落地建议如果团队已经在用 Prompt 方式让模型输出引用迁移到 Citations 特性后有几个直接收益Token 成本降低cited_text 不计入输出 Token、引用可靠性提升API 保证引用指向真实文档位置、引用质量改善官方评估表明 Citations 特性比纯 Prompt 方式更倾向于引用最相关的原文。但 Citations 特性不是万能的。它只适用于在请求中直接传入文档的场景对 Agent 工具调用返回的结果不生效。如果 Agent 通过工具从外部系统获取数据这些数据需要先以document类型传回给模型才能启用引用。这意味着你需要调整 Agent 的调用链工具返回的数据→以document类型传给模型→模型回答时自动引用。另一个需要注意的点是当前版本要求所有文档要么全部启用引用要么全部禁用。如果某些文档不需要引用但又不想被排除可以考虑把这些文档以普通文本类型传入而不是作为document类型。对于生产环境建议在用户侧或管理后台展示引用来源。cited_text可以直接渲染为可点击的高亮文本document_title和位置信息可以作为 tooltip 或脚注展示。这比纯文本回答多了一层交互但用户对 Agent 回答的信任度会显著提升。Citations 特性解决的不是模型能力问题而是可信度问题。当模型回答可以追溯到具体原文时Agent 从黑盒生成器变成了可验证的信息整理器。对于企业级 RAG 应用、合同审查 Agent、合规问答系统等场景这种可验证性可能是能否上线的分水岭。学习资源推荐如果你想更深入地学习大模型以下是一些非常有价值的学习资源这些资源将帮助你从不同角度学习大模型提升你的实践能力。一、全套AGI大模型学习路线AI大模型时代的学习之旅从基础到前沿掌握人工智能的核心技能​因篇幅有限仅展示部分资料需要点击文章最下方名片即可前往获取二、640套AI大模型报告合集这套包含640份报告的合集涵盖了AI大模型的理论研究、技术实现、行业应用等多个方面。无论您是科研人员、工程师还是对AI大模型感兴趣的爱好者这套报告合集都将为您提供宝贵的信息和启示​因篇幅有限仅展示部分资料需要点击文章最下方名片即可前往获取三、AI大模型经典PDF籍随着人工智能技术的飞速发展AI大模型已经成为了当今科技领域的一大热点。这些大型预训练模型如GPT-3、BERT、XLNet等以其强大的语言理解和生成能力正在改变我们对人工智能的认识。 那以下这些PDF籍就是非常不错的学习资源。因篇幅有限仅展示部分资料需要点击文章最下方名片即可前往获取四、AI大模型商业化落地方案作为普通人入局大模型时代需要持续学习和实践不断提高自己的技能和认知水平同时也需要有责任感和伦理意识为人工智能的健康发展贡献力量。

相关新闻