跳到主要内容

任务指南

每篇解决一个具体问题。带着问题来,拿着答案走——不用通读,翻到你需要的那一节就行。

1. 接入微信公众号

你要做什么: Agent 已经在 OpenHex 上调好了,想让客户在公众号里直接跟 Agent 对话。

前置条件:

  • 一个已认证的微信服务号
  • Agent 已在 OpenHex 上发布

操作步骤:

  1. 打开 Agent 编辑页 → 发布 → 渠道管理 → 添加渠道 → 选择「微信」
  2. 填写公众号信息:输入 AppID 和 AppSecret。在微信公众平台 → 设置与开发 → 基本配置 里获取
  3. 配置服务器:OpenHex 自动生成服务器 URL 和 Token,把这组信息填到微信公众平台 → 设置与开发 → 基本配置 → 服务器配置
  4. 在微信公众平台开启消息推送。回到 OpenHex 后台,点「测试连接」

验证:

  • 用自己的微信号给公众号发一条消息
  • Agent 正常回复,说明接入成功
  • 在 OpenHex 会话管理里查看这条会话,确认沙箱日志正常

常见坑:

  • 收不到消息 → 服务器 URL 或 Token 两边填的不一致,逐字核对
  • 回复慢 → 沙箱执行耗时过长,去会话详情看耗时,优化技能代码
  • 菜单不显示 → 公众号菜单是在微信公众平台单独配置的,OpenHex 不管菜单

2. 构建行业专属测试集

你要做什么: 平台自带的几条测试用例太通用,看不出来 Agent 在你这行的真实水平。要建一套你自己的测试用例。

前置条件: Agent 已创建,知识库已上传。

三种来源,按优先级:

  1. 从真实会话导入(最有用)→ 会话详情页 → 找到回答不佳的消息 → 点「加入测试集」→ 编辑期望回答
  2. 手动添加 → 测试页 → 新建测试用例 → 写「用户会怎么问」+「期望回答的关键要点」
  3. 系统自动生成 → 选行业模板后自动生成 4 条,作为起点

怎么写期望回答:

写关键要点,不要写逐字标准答案。比如:

用户问题:T恤发洛杉矶,FOB 报价多少?
期望回答:
- 给出具体单价(含币种)
- 注明贸易术语 FOB
- 注明起订量(MOQ)
- 给出有效期

写太死(「回答必须包含"FOB 洛杉矶 $3.85/件"」)→ 系统按全文匹配打分,Agent 换个说法就判错。

测试集怎么组织:

按场景分类,每类 10-20 条:

  • 报价类:不同产品、不同数量、不同目的地
  • 售后类:退换货、质量问题、物流查询
  • 技术类:产品规格、材质、认证

每个核心意图至少 3 条用例。比如「询价」这个意图,要有「500 件多少钱」「1000 件多少钱」「换纯棉面料加多少钱」各一条。

验证:

跑一次回归测试(Agent 编辑页 → 测试 → 开始测试),看每条用例的得分。得分低于 80 的,点进去看 Agent 实际回答了什么,调整期望答案或修 Agent 配置。

常见坑:

  • 期望答案写太死,Agent 换了个说法就被判错
  • 只有正向用例,没有边界和异常用例(客户问「能不能便宜点」「你们和 XX 比怎么样」)
  • 测试集建完就再也不更新了——应该每周从会话监控里捞 5-10 条新用例

3. 定义业务本体

你要做什么: 客户问「纯棉 T 恤 500 件 FOB 洛杉矶多少钱」——Agent 不能每次都去翻文档,要把价格、规格、物流这些结构化数据直接查出来。

前置条件: Agent 已创建,知识库里有产品/服务数据。

本体 vs 知识库:

知识库业务本体
数据形式非结构化文档片段结构化表和字段
来源你上传的原始文件文档自动解析 + 对话自动沉淀
用途语义检索,喂给大模型精确查询,直接引用
例子「产品目录里有一段关于 T 恤的描述」「T 恤 / 纯棉 180g / $3.85/件 / FOB 洛杉矶」

简单说:知识库是 Agent 的「阅读理解材料」,本体是 Agent 的「数据库」。

操作步骤:

  1. Agent 编辑页 → 本体 → 新建字段
  2. 定义字段:比如外贸场景,至少定义这些——产品名、面料、克重、FOB 价、CIF 价、MOQ、交期
  3. 上传数据:手动填表,或上传 Excel/CSV 让系统自动解析
  4. 知识库里的文档也会被自动解析,提取结构化信息填入本体

字段怎么定义:

  • 字段名要具体,不要一个「价格」字段——分 FOB 价、CIF 价、EXW 价
  • 如果是服务类(如留学),字段可以是:学校名、专业、排名、托福要求、学费
  • 每个字段设好类型:数字、文本、日期、枚举(如物流方式:海运/空运/快递)

验证:

在演练场问「纯棉 T 恤 500 件 FOB 洛杉矶多少钱」,Agent 应该返回精确数值,而不是「我们的 T 恤价格很有竞争力」这种废话。

常见坑:

  • 字段太粗——一个「价格」字段 vs 分 FOB/CIF/EXW,Agent 查不到精确数据
  • 数据没更新——产品价格变了,本体里还是旧的,Agent 报错价
  • 本体和知识库打架——本体里写 $3.85,知识库文档里写 $4.00,Agent 不知道该信哪个

4. 配置阶梯报价

你要做什么: 客户问「500 件多少钱」和「5000 件多少钱」,价格不一样。Agent 要自动按数量匹配正确的价格阶梯。

前置条件: 本体已定义产品和价格字段。

实现方式: 阶梯报价通过 Skill 实现——在沙箱里写一段报价逻辑,绑定到 Agent。

操作步骤:

  1. Agent 编辑页 → 技能 → 新建技能
  2. 写报价逻辑,核心是数量区间 → 单价 → 计算总价的映射:
数量阶梯示例:
100-500 件 → $4.50/件
501-2000 件 → $4.00/件
2001-5000 件 → $3.60/件
5000+ 件 → $3.20/件
  1. 技能里定义好:客户说了什么 → 触发报价技能 → 从本体查产品基础信息 → 按数量匹配阶梯 → 计算总价 → 返回报价
  2. 保存技能 → 绑定到 Agent → 在演练场测试

边界处理:

  • 500 件算第一档还是第二档?你定规则,技能里写清楚(建议:≥ 501 才算第二档)
  • 报价是否含运费?不含的话要在回复里说明
  • 客户问「能不能便宜」——技能里可以加老客户折扣逻辑

验证:

在演练场分别问 300 件、800 件、3000 件的价格,确认 Agent 自动匹配正确的阶梯,并且总价计算正确。

常见坑:

  • 边界值归属不清——500 件算哪一档,技能里没写清楚,Agent 随机选
  • 报价不含运费但没说——客户以为包邮,下单后发现还要加钱
  • 汇率没缓存——每次报价都调汇率 API,沙箱成本翻倍

5. 设置人工介入规则

你要做什么: Agent 不是万能的。客户情绪激动、问退款、或者 Agent 连续答不上来——这些情况要自动转给真人处理。

前置条件: Agent 已发布,有可用的通知渠道(邮件、飞书、企微等)。

实现方式: 在 Skill 里写介入判断逻辑,绑定到 Agent。

三种触发规则:

规则类型触发条件适用场景
关键词触发客户消息含「投诉」「退款」「人工」「找你们领导」情绪激动、明确要找人
低置信度Agent 回复里含「不确定」「建议咨询」「可能需要」Agent 自己都没把握
连续追问同一个问题客户问了三遍还没解决Agent 在绕圈子,客户快失去耐心了

操作步骤:

  1. Agent 编辑页 → 技能 → 新建技能

  2. 写介入判断逻辑:

    • 匹配关键词 → 触发人工介入
    • 或检测 Agent 回复置信度 → 低于阈值触发
    • 或检测同一话题轮次 → 超过 3 轮未解决触发
  3. 定义介入动作:发邮件给负责人 / 推送飞书消息 / 企微通知

  4. Agent 回复客户:「您的问题已转接给 XXX,预计 2 小时内回复。」

  5. 保存技能 → 绑定到 Agent → 测试

验证:

在演练场输入触发关键词(如「我要投诉」),确认:

  • Agent 回复了转接话术
  • 通知正常发到了邮箱/飞书/企微

常见坑:

  • 规则太敏感——客户说「这个价格不太满意」就被转人工,正常议价也被打断
  • 规则太松——客户连问三遍「人工客服」Agent 还在自动回复
  • 通知发出去了但没人处理——介入是通知真人,不是替代真人,要确保有人接

6. 开通收款与订阅

你要做什么: Agent 提供的是付费服务——留学选校方案、合同审核、诊断报告——客户付了钱才能用。

前置条件: Agent 已发布,服务内容明确,你知道要收多少钱。

三种收费模式:

模式适合场景举例
按次收费单次服务明码标价留学选校方案 ¥99/次
按量收费按实际消耗计费每 1000 token ¥0.05
订阅收费持续服务按月收会员 ¥199/月,无限次咨询

操作步骤:

  1. Agent 编辑页 → 计费 → 选择收费模式
  2. 设置价格:按次填单次价格,按量填单价,订阅填月费
  3. 绑定支付方式:支付宝 / 微信支付(企业版支持银行转账)
  4. 发布
  5. 用测试手机走一遍完整支付流程

三种模式怎么选:

  • 你的服务是「一次交付一个结果」的(选校方案、合同审核、报价单)→ 按次
  • 你的服务是「持续对话消耗 token」的(客服、咨询)→ 按量
  • 你的客户是「长期关系按月付费」的(会员制咨询)→ 订阅

验证:

用测试手机走一遍完整流程:扫码 → 触发付费 → 付款 → Agent 正常服务。确认付款后 Agent 没有卡住。

常见坑:

  • 价格设置后改不了——需要新建版本再改价格,别直接改已发布的版本
  • 支付回调失败——客户付了钱但 Agent 没收到通知,不提供服务。先查支付渠道的回调配置
  • 免费额度没关——开了收款但 Agent 还在用免费额度服务,客户不付钱也能用

7. 排查 Agent 答非所问

你要做什么: Agent 明明知识库里有答案,但回复的内容不对、不相关、或者瞎编。要找到根因,修好,然后防止再犯。

诊断四步法:

第一步:查知识库。 在演练场搜同样的问题,看知识库有没有召回相关内容。

  • 没召回 → 补充知识库,检查文件格式(扫描件 PDF 不可检索,转成 Markdown)
  • 召回了但内容不对 → 知识库里的信息有误,修正

第二步:查 System Prompt。 Prompt 里的规则是否和知识库冲突?

  • 比如 Prompt 写「报价时不要直接给价格,先了解客户需求」→ 但知识库里有明确报价,Agent 被 Prompt 拦住了
  • 解决:统一 Prompt 和知识库的内容,不一致时以知识库为准,Prompt 是兜底规则

第三步:查本体。 结构化数据是否正确、是否被检索到?

  • 本体里价格字段是空的 → Agent 查不到,只能瞎编
  • 本体字段名太模糊 → Agent 匹配不到

第四步:查幻觉。 Agent 是不是在编造信息?

  • 看回复里有没有「来源」标注——没有的话很可能是编的
  • 解决:在 System Prompt 里加约束:「不确定就说不知道,不要编造数字」

常见病因 → 药方:

症状根因怎么修
答不上来知识库缺资料补知识库
答错了知识库信息有误或检索不准确修正知识库 + 调整切片大小
编造了System Prompt 没约束加:「不确定的事说不知道」
格式乱了没要求输出格式在 Prompt 里加模板要求
答非所问检索召回不相关的内容优化知识库文件结构,按主题拆分

修完之后:

把刚才的问题加入测试集。下次改配置时,这条会自动回归——确保不会再犯同样的错。



最后更新:2026-09-08