场景 场景

文档问答场景

面向企业文档、制度、产品资料、合同、知识库和工单的文档问答场景,强调 RAG、引用溯源、权限过滤、拒答策略和评测集。

use-casedocument-qaragenterprise-knowledge-basenemo-retrieverllamaindexvllm
Slug
document-qa-use-case
更新
2026-05-01
来源
4
关系
6

概览

文档问答场景用于让用户围绕 PDF、Word、PPT、Excel、网页、Markdown、扫描件和业务系统文档进行自然语言提问。它通常是企业知识助手、客服助手、政务政策问答和行业知识库的基础能力。

该场景的核心不是让模型自由回答,而是让回答基于可检索文档,并返回引用、权限和可追溯记录。

官方可确认的信息

根据 NVIDIA 和 LlamaIndex 官方资料:

  • NVIDIA RAG 资料说明检索增强生成通过检索外部数据增强模型回答;
  • NVIDIA NeMo Retriever 面向企业检索和 RAG 工作流;
  • LlamaIndex 文档将 RAG 描述为连接私有或领域数据与 LLM 的常见方式;
  • vLLM 面向高吞吐、内存高效的大模型推理服务;
  • Triton Inference Server 支持多框架模型服务化。

这些事实说明,文档问答需要把文档解析、检索、重排、生成、引用和权限治理组合起来。

典型任务

1. 制度和流程问答

回答公司制度、审批流程、政务政策、合规条款和操作手册相关问题。

2. 产品和售前资料问答

围绕产品手册、方案文档、报价规则和案例库回答售前或客服问题。

3. 合同和项目资料问答

对合同、招投标文件、项目交付文档和会议纪要做引用式问答。

4. 扫描件和表格问答

需要 OCR、表格抽取、版面解析和字段结构化,难度高于普通文本问答。

工程估算说明

以下不是官方固定配置,而是文档问答项目规划口径:

  • 文档量不是唯一指标,扫描件比例、表格复杂度、权限层级和更新频率会显著影响成本;
  • 文档切分策略应按标题层级、表格、段落、图片和附件单独设计;
  • 回答必须返回来源引用,没有命中依据时应拒答或提示不确定;
  • 企业场景应先做权限过滤再检索,避免越权召回;
  • 验收指标应包括检索召回、引用正确率、拒答正确率、权限正确率和响应延迟。

方案评估

需要结合您的业务场景做方案评估?

从业务目标、数据边界、GPU 配置、推理延迟和上线周期评估方案。

咨询部署方案查看 AI 解决方案