产品介绍
Coval 是什么?
Coval 是语音 AI 智能体测试与评估平台。它将上线前模拟、真实通话评估、人工质量审核、可观测性和回归测试整合成持续闭环,让产品、QA、运营和合规团队在上线前后使用相同质量标准。
模拟系统可大规模运行真实来电者、规则、噪声、口音、打断、工具操作和复杂工作流。生产评估从真实对话中识别漂移和重复故障;高风险、失败或低置信度通话可分配给人工审核,再用审核判断改进指标和后续测试集。
如何使用 Coval
- 通过支持的平台、电话端点或自定义 webhook 连接语音智能体。
- 定义来电者角色、场景、规则和智能体必须处理的行为。
- 配置内置或自定义评估指标。
- 在发布前运行模拟对话并检查失败。
- 对生产通话应用相同指标以识别漂移。
- 将重要通话交给人工 QA,并把发现转为回归测试。
核心功能
- 语音模拟: 使用不同来电行为和音频条件运行大量真实对话。
- 生产评估: 从质量、解决率、安全和体验维度衡量真实通话。
- 人工 QA: 将选定通话分配给审核人员并记录判断。
- 回归测试: 在提示、模型、供应商和工作流变化后重复测试。
- 行为评估: 检查身份验证、转接、信息收集、事实依据和偏题处理。
- 供应商比较: 在多个语音 AI 服务商上运行相同场景。
使用场景
- 上线前验证: 在真实客户使用前测试边缘案例。
- 生产监控: 发现质量漂移和重复通话故障。
- 合规审核: 验证敏感工作流是否遵守必要规则。
- 供应商选型: 用相同场景和指标比较智能体平台。
- 发布门禁: 部署变更前运行语音智能体回归测试集。
价格
Starter 套餐每月 100 美元,包括 100 分钟模拟、1,000 个受监控通话、30 天 trace 保留、不限席位和 50 个自定义指标。提供 7 天试用,需要信用卡。Growth 和 Enterprise 套餐提供更高用量、保留时间、项目数、控制与支持。
常见问题
Coval 可以评估生产通话吗?
可以。Coval 对真实对话运行生产评估,并找出故障和质量漂移。
支持人工审核吗?
支持。高风险、失败和低置信度通话可分配给人工 QA。
可以比较不同语音 AI 供应商吗?
可以。Coval 可在不同供应商上运行相同场景进行有依据的比较。


