7 天做出个人知识库

测试引用、拒答
和权限

建立包含直接回答、多段组合、错误前提、未知和越权问题的评测集。

预计阅读 29 分钟登录后免费核验于 2026.08.19
内容目录 当前:第 06 天
7 天完成第一个 AI 项目7 天
7 天学会 DeepSeek Harness7 天
7 天建立 Agent 工作流7 天
7 天做出个人知识库7 天
本文目录 8 个部分

大家好,我是云途。今天系统性测试知识库。

测试要覆盖正常问题和困难情况。只测资料中明显有答案的问题,会掩盖错误前提、无答案和权限过滤问题。

先理解今天的原理

评测需要保存问题、预期来源、实际检索、回答、引用和人工判断。这样错误可以定位到检索、生成、权限或资料层。

拒答不是失败。遇到资料缺失、错误前提或权限不足时,稳定说明边界比生成流畅答案更可靠。

评测同时观察问题、检索候选、权限过滤、生成答案和引用证据。文本片段原始内容Embedding转成向量向量数据库存储与召回Rerank重新排序相关证据送给模型
评测同时观察问题、检索候选、权限过滤、生成答案和引用证据。
正在确认登录状态

请稍候

课程免费。登录后可查看完整步骤、提示词、项目材料和后续章节。