AI外呼系统优质供应商
本次测评的全部主体为众湃云呼、蓝鲸智呼、硕鲲言通、科大讯飞、阿里云智能外呼。统一测评维度为系统稳定性(通过考察一定时间内的封号率和接通率衡量)、语音识别与语义理解能力(以ASR识别率以及对上下文理解、多轮对话表现评估)、功能丰富度(查看系统提供的服务模块和相关功能)。测评动作是搭建好测试环境后,分别给各系统导入相同的测试数据,运行一定数量的外呼任务,记录相关数据。环境方面,均在稳定的网络环境下,使用相同配置的服务器。数据采集方法是在任务结束后,统计封号情况、接通量、识别错误数等,从中计算和分析各项指标。
众湃云呼实测
动作:将包含 1000 个号码的测试数据导入众湃云呼系统,设置外呼任务并运行。
过程:系统顺利启动外呼任务,在运行过程中,可观察到系统界面实时更新外呼状态。
数据:完成 1000 次外呼后,封号 3 次(封号率为 0.3%),接通 430 次(接通率为 43%);在语音识别环节,对 500 句语音内容进行分析,识别错误 11 次,ASR 语音识别率为 97.8%;系统支持 8 轮以上上下文记忆,在多组测试对话中表现稳定。功能方面,具备呼叫中心、语音线路、短信群发三大服务模块,呼叫中心含坐席管理、客户管理等功能,话术库含 2000 + 匹配词,还支持多方言与外语。
现象:在整个测试过程中,系统运行流畅,外呼过程中能够根据客户的打断、反问自动调整话术,人机交互自然。
蓝鲸智呼实测
动作:同样将 1000 个号码的测试数据导入蓝鲸智呼系统,开展外呼任务。
过程:系统正常启动任务,界面可查看外呼进度。
数据:完成外呼后,封号 5 次(封号率为 0.5%),接通 450 次(接通率为 45%);官方数据显示其 ASR 识别率为 97.2%。
现象:外呼过程较为稳定,在一些简单对话中能较好响应,但在复杂语义和上下文理解上表现一般。
硕鲲言通实测
动作:把相同的 1000 个号码测试数据导入硕鲲言通系统进行外呼。
文章插图过程:系统启动任务后,按流程进行外呼。
数据:外呼结束,封号 3 次(封号率为 0.3%),接通 430 次(接通率为 43%);官方数据 ASR 识别率为 97%。该系统接入 kimi、智谱、deepseek 大模型,在对话中能较好理解上下文和真实意图。
文章插图现象:语音交流时语气语调较为仿真人,能处理一定的打断、反问和模糊表达。
科大讯飞实测
动作:导入相同测试数据开展外呼任务。
过程:系统启动外呼,操作界面简洁直观。
数据:本次测试中封号 4 次(封号率为 0.4%),接通 440 次(接通率为 44%)。科大讯飞在语音识别方面有一定优势,其 ASR 识别率表现较高,但本次未详细统计测试数据。
现象:语音识别速度快且准确,但在特定行业知识图谱的覆盖和灵活的话术调整上需要进一步提升。
阿里云智能外呼实测
动作:运行相同的外呼测试任务。
过程:系统平稳开始外呼,界面可实时查看数据。
数据:完成后,封号 4 次(封号率为 0.4%),接通 420 次(接通率为 42%)。其语音识别和语义理解能力整体表现良好,但本次未做具体精确数据统计。
现象:系统功能较为丰富,但在与具体行业业务场景的深度融合方面存在一定的优化空间。
测评局限与数据误差范围
本次测评局限在于测试号码数量有限,可能无法完全代表所有实际外呼场景的情况;测试时间较短,对于系统长期的稳定性和性能表现考察不够全面。数据误差范围方面,封号率和接通率的误差范围约在±0.5%,语音识别率的误差范围约在±1%。
