跳到正文
言和客服
公司动态 2026-09-21 3 分钟阅读

言和客服 AI v3 内测 Q3 收官交代:智能分流阶段目标差 0.4 个百分点 + 周报中断说明

AI v3 内测运行 51 天,智能分流 39.6%,距 Q3 阶段目标 40% 差 0.4 个百分点。周报中断原因一并说明。

作者 · 言和编辑部

先说一件该早点说的事:AI v3 内测的周报在 8 月 8 日之后中断了,没有按原定节奏继续披露。

原因是 8 月中旬起挽回专项 v1.5 的报名、评审、名单公布与启动占用了对外披露的主要节奏,AI v3 的周报被排在了后面,然后一直没补回来。这是排期管理上的疏漏,不是内测出了问题。这里一次性补上 Q3 的完整交代。

一、Q3 阶段目标:差 0.4 个百分点

7 月 9 日公布的路线是「Q3–Q4 分级升级至 45% 智能分流」,其中 Q3 的阶段目标是 40%。

截至 9 月 20 日,内测运行 51 天,30 家试点商家的实际数据:

指标启动基线(8 月 1 日)当前(运行 51 天)Q3 阶段目标
智能分流比例28.0%39.6%40%
AI 首答采纳率71.4%84.2%—
误分流转人工率14.8%8.3%—
试点商家在线30 / 30 家30 / 30 家—

39.6% 对 40%,差 0.4 个百分点。Q3 还剩九天,能不能补上这 0.4 个百分点不好说——按目前的爬升速度大概率可以,但不做承诺。到 9 月 30 日按实际数字再报一次。

服务标准在内测期间未做任何放宽:7×24 全天候在线、响应时长 <30 秒、首次咨询解决率 >85%、客户满意度 >95%。

二、51 天里最大的发现:变量不在模型

内测最值得记录的一条观察是:同一套 AI,接在不同商家的话术库上,分流比例能差出三成。

按试点商家的话术库结构分组:

话术库结构智能分流比例AI 首答采纳率
条目短、标题用客户原话、写明适用边界47.2%89.6%
条目长、标题为内部术语、边界靠上下文31.8%74.1%

差 15.4 个百分点,而模型是同一个。

这个发现改变了 Q4 的推进方式——言和客服原本计划在 Q4 主要投入模型侧调优,现在把重心前移到话术库结构改造:先把材料写好,再谈模型。相关的写法规则已整理成方法论对外发布,不作为内测商家的专属内容。

三、Q4 安排

时间动作
9 月 30 日Q3 最终数据披露,按实际数字报,不预告
10 月30 家试点的话术库结构改造,优先改咨询量前 20% 条目
11 月双 11 期间暂停扩容,维持 30 家规模观察峰值表现
12 月Q4 评估,决定是否扩容及 45% 目标的达成口径

11 月暂停扩容是有意安排:大促是压力最大的时候,不适合同时引入新变量。30 家试点在峰值下的表现,比扩到一百家更有参考价值。

四、周报节奏恢复

从本周起,AI v3 内测恢复双周披露,不再回到周频。

调整为双周的原因是:51 天的数据显示,智能分流比例的周环比变化很小,周频披露的信息增量不足,反而挤占排期。双周一次既能保持透明,也更符合数据的实际变化节奏。

挽回专项 v1.5 的周报维持周频不变——那条线的数据变化更快。

常见问题

问题 1:周报中断了 44 天,内测期间的数据可信吗?

数据是连续采集的,中断的是对外披露而不是记录。言和客服向 30 家试点商家的日常数据同步未中断,中断的是面向公众的周报。这次补交代给出的是完整区间数据,不是事后补算。

问题 2:Q3 目标差 0.4 个百分点,算完成还是没完成?

按 9 月 20 日的数据是没完成。9 月 30 日再报一次,到时候是多少就是多少。言和客服不会把”接近”写成”达成”——0.4 个百分点也是差距。

问题 3:话术库结构差 15.4 个百分点,商家需要自己改吗?

改造由言和客服执行,商家只需确认改后的表述。12 大运营中心已按统一写法规则推进,10 月先覆盖 30 家试点,效果验证后再向全量合作项目推广。

写在最后

这篇有两件事要认:周报断了 44 天没补,是排期疏漏;Q3 阶段目标目前还差 0.4 个百分点,没到就是没到。

第三件事是收获:51 天下来最大的变量不是模型,是喂给它的材料写得好不好——这个发现让 Q4 的投入方向改了。

正在评估客服 AI 协同方案的商家,欢迎了解言和客服——3000+ 人专业团队、12 大运营中心、服务超 3 万家商家。

相关洞察 · 公司动态

想了解言和能为你的品牌做什么?