用你的任务验证效果
第一次导入与检索跑通后,换成你工作中的资料或会话,验证它能否帮你找到依据、复用经验或产出内容。先选一个场景,得到结果后再扩展。
| 你希望改善什么 | 从哪里开始 | 看什么结果 |
|---|---|---|
| 查项目资料时少翻文件 | 资源导入与检索 | 能找到回答问题所需的原文,而不只是返回相似词 |
| Agent 在新会话里复用已有背景 | 选择 Agent 接入方式 | 记忆确实被保存,并在相关任务中召回;用户不必再次输入相同背景 |
| 把散落资料整理成可读的内容 | 上下文编译 | 产物引用或使用了哪些来源,结构是否适合后续阅读,是否仍有遗漏或错误 |
用自己的资料检查检索
选一小组你熟悉的资料,例如项目说明、操作手册或一次问题复盘。按快速开始导入,再准备几个你知道答案的问题。每个问题记下预期来源,检索后读取返回的 URI,核对原文。
至少覆盖三种情况:资料中有直接答案;答案需要结合两处内容;资料中没有答案。记录是否找到依据、是否漏掉关键内容,以及后续 Agent 回答是否忠于原文。find 返回 URI 和分数,生成回答还需要你的 Agent 或应用读取并使用这些内容。
首次成功后,再逐步加入其他来源。这样发现问题时,可以判断是资料处理、检索还是回答生成出了偏差。结果不符合预期时,使用观测与排障检查处理状态和请求行为。
用两次会话检查记忆
先查看集成能力对照,确认你选的插件支持哪些自动捕获、提交和召回行为,再按该插件的验证步骤操作。
- 在第一次会话中提供一条无敏感信息、后续确实会用到的偏好或项目背景。
- 按插件的提交机制结束或提交会话。检查处理状态、实际生成的记忆及其用户或 Peer 归属;提交成功不保证产生某条记忆。
- 用同一身份开启新会话,提出需要该背景的任务,不再次输入那条信息。检查召回记录与最终回答,确认 Agent 使用了保存的内容。
- 再问一个无关问题,观察旧背景是否被不恰当地带入回答。
插件安装成功不等于记忆验证完成。若没有产物,检查会话与记忆提取;已有产物却没有召回时,检查身份、检索范围和插件行为。应用自己管理会话时,从应用开发路径进入对应 API。
用一份产物检查上下文编译
选择知识 Wiki、知识图谱或日报中的一种,按教程准备来源并执行。先确认任务完成和产物位置,再检查内容:
- 关键事实是否能回到来源核对?
- 有哪些遗漏、重复或没有依据的表述?
- 你能否用产物完成原本的阅读或整理任务?
第一次选你熟悉的来源,便于识别错误。任务成功或文件生成,只说明处理完成;产物是否可用仍需要核对。
有结果后,选择一条继续路径
| 当前结果 | 下一步 |
|---|---|
| 文档检索满足需要,想在日常工具里使用 | 接入已有 Agent |
| 已验证能力,准备写入自己的应用 | 应用开发路径 |
| 想使用 OpenViking 自带的 Agent | VikingBot 安装与配置 |
| 准备让团队共享服务 | 选择部署路径,再核对身份与访问控制 |
| 想理解结果背后的机制 | 概念与原理 |
保留试用中的问题、预期来源和实际结果,后续改配置或升级时用同一组任务复查。若要比较使用前后的变化,保持任务、模型与输入条件一致;检索分数和单次成功不能代替效果比较。