Salesforce 于 2026 年 9 月 15 日发布基于 NVIDIA Nemotron 的 CRM 推理模型 Koa。它把行业模型的话题带到了销售与服务业务。企业评估这类模型时,需要看它能否正确理解自己的业务规则,并完成一项有结果可查的任务。Salesforce 官方公告
官方公告显示,Koa 当前面向部分试点开放,计划于 2026 年冬季在美国区域正式提供。企业应先确认可用范围,再安排接入验证。
评估任务的选择
可以从商机复盘、跟进建议和服务工单分流中选取一种。每个样本提供固定时间点的资料,要求输出相同字段,由业务负责人提前写好判定标准。把最终成交结果藏在测试资料中,会让预测测试失去意义。
例如,某商机有一份已发送的报价和一次技术沟通,但没有采购确认。模型可以建议补问预算、采购程序和交付时间,不能据此写成“已获得订单”。销售阶段的定义应来自现行制度,不能由模型临时编一套。
业务规则的覆盖
| 测试项目 | 输入条件 | 合格表现 |
|---|---|---|
| 阶段判断 | 有报价、无采购确认 | 保留当前阶段并说明缺口 |
| 金额汇总 | 不同币种、不同含税口径 | 分别列示或按明确规则换算 |
| 下一步建议 | 联系人已离岗 | 指出联系人信息需要更新 |
| 服务分流 | 故障描述与型号不匹配 | 先补资料,不直接派错工种 |
| 权限限制 | 无权查看其他区域记录 | 拒绝越权并说明可查范围 |
这些是自建评估要求,不代表某个产品已经自动满足。模型具备行业知识,也仍需接入组织自己的阶段规则、产品目录和有效业务记录。
证据与推断的区分
复盘结果应分别列出已发生事项、尚未确认的信息以及建议动作。每条关键事实能够回到原始记录,引用要匹配当前对象,不能把同名企业或相似项目的资料混在一起。
对于“本月可能签约”等判断,应说明依据和未满足条件。如果原始消息只说“争取月底”,输出中应保留这一不确定性。主管需要看到判断为何变化,而不是得到一个看似精确、无法解释的百分比。
公平的模型对照
比较专用模型与通用模型时,保持资料范围、工具权限和任务目标一致。分别记录模型本身的判断错误、检索漏项以及业务接口问题,避免把知识库整理效果全部算到模型头上。
测试要包含完整的多轮过程:员工补充资料、模型重新查证、形成建议,再核对正式记录。一次回答流畅不能代表后续执行稳定。若某模型需要更多轮纠错,应把人工时间和重复调用费用一起计算。
投入使用的条件
按错误后果确定使用范围。摘要遗漏一句背景与把未签约商机改成已成交,不能放在同一个平均分里。涉及阶段、负责人和金额变更时,应单列错误,核对授权与更正流程。
交付记录保留模型版本、规则版本、样本日期、原始资料范围和评分结果。上线后的业务抽查继续沿用这些标准;产品升级或业务制度改变时,重新跑受影响样本。最终选择应同时考虑可完成任务比例、人工修订量、完整任务费用以及接入维护条件。
评估样本可结合企业 Agent 验收方法整理,业务资料建设可参考面向 Agent 的系统接口交付。具体岗位范围见企业 Agent 落地。







