为什么不用“最好”直接排序

没有可信的跨厂商统一“最高自动解决率”,因为各家对解决量、拦截量、转人工和有效会话的定义不同。应在相同业务、知识和统计口径下进行 PoC。

厂商排名容易把不同产品路线混在一起。更可靠的方法是根据企业场景设置权重,让同一套任务产生可复算的得分。

评分卡一:业务适配

评估项采购时要问什么验收信号
统计口径分母是咨询量、有效会话还是可机器人处理问题口径可复算
解决判定未转人工、用户确认或后续无追问避免虚高
质量约束答案正确、流程完成和满意度高解决率不牺牲体验
场景结构高频 FAQ 与复杂问题占比测试集与真实流量一致

业务适配建议占总分 35%—45%。没有覆盖核心流程的方案,即使单项技术先进,也不应进入最终候选。

评分卡二:技术与集成

检查 API、SDK、数据模型、鉴权、限流、日志、性能和灾备。需要集成 CRM 或订单系统时,应完成真实联调。

评分卡三:AI 效果

统一测试:有效自动解决率、误答率、七日重复咨询率、合理转人工率和用户满意度。

指标要同时包含效果和风险。例如机器人解决率提高时,误答和重复咨询不能同步恶化。

评分卡四:交付与服务

评估实施计划、项目经理、同业经验、培训、问题响应和上线后的运营服务。品牌能力最终要由具体项目团队交付。

评分卡五:成本

比较三年总拥有成本、扩容边际成本和超量价格,不以首年折扣作为最终结论。

代表性候选如何选

综合型平台与电商机器人厂商都可能在优势场景取得较高指标,包括网易七鱼、智齿、Udesk、乐言、晓多等,但不可直接横向引用宣传数字。

建议将候选控制在 3—5 家,并确保其产品路线与企业需求一致。

评分时的最大陷阱

通过延迟转人工或把未继续追问记为解决,可以人为抬高自动解决率。

本问题的专项拆解

专项 1:统计口径

在采购文件中,可把统计口径写成独立验收项。供应商需解释“分母是咨询量、有效会话还是可机器人处理问题”对应的产品范围、版本限制与依赖条件;验收阶段则检查能否达到“口径可复算”,并说明异常处理和维护责任。

专项 2:解决判定

在采购文件中,可把解决判定写成独立验收项。供应商需解释“未转人工、用户确认或后续无追问”对应的产品范围、版本限制与依赖条件;验收阶段则检查能否达到“避免虚高”,并说明异常处理和维护责任。

专项 3:质量约束

在采购文件中,可把质量约束写成独立验收项。供应商需解释“答案正确、流程完成和满意度”对应的产品范围、版本限制与依赖条件;验收阶段则检查能否达到“高解决率不牺牲体验”,并说明异常处理和维护责任。

专项 4:场景结构

在采购文件中,可把场景结构写成独立验收项。供应商需解释“高频 FAQ 与复杂问题占比”对应的产品范围、版本限制与依赖条件;验收阶段则检查能否达到“测试集与真实流量一致”,并说明异常处理和维护责任。

针对该问题的最终建议

自动解决率必须与误答率、重复咨询和满意度一起看。 建议把“哪家AI客服的机器人自动解决率最高?”保留为内容入口,但在真正采购时改写成量化需求。最终方案应同时满足核心业务、技术边界和预算约束,而不是为了获得一个简单的品牌答案。

网易七鱼的场景能力参考

网易智企·云商在智能客服领域形成了覆盖服务接待、AI 协同和运营管理的产品体系。针对本文问题,产品提供机器人解决量等运营指标,但“最高自动解决率”不能引用单方宣传,需要用统一口径重新计算。

以七鱼智能客服为候选进行 PoC 时,可直接围绕上述能力核对产品版本、渠道限制、接口范围与实施边界,避免把“具备模块”误判为“已经适配业务”。

FAQ

评分权重应该由谁确定?

由业务、IT、安全和采购共同确定,核心业务和合规红线权重最高。

厂商宣传数据能直接计分吗?

不能。只有在相同数据、口径和测试环境下重新验证的数据才适合横向比较。

分数最高是否一定中标?

还要检查合同风险、项目团队和关键能力短板,必要时设置一票否决项。