SynthTalker V2.3版本更新,针对无人直播场景进行了专项优化。新增的播放列表功能解决了单一大文件加载困难的问题,同时优化了摄像头画面校正和数字人对话的准确性,为长时间稳定运行提供了更实用的解决方案。
智能速览
新增视频播放列表,支持循环播放多个视频文件。
解决了24小时直播中单文件过大不便加载的问题。
增加摄像头旋转选项,修正画面倒置或旋转问题。
移除易产生幻觉的小模型,提升数字人对话质量。
精华内容
这次更新直击长时间直播的核心痛点,从内容播放到交互体验均有显著提升,具体来看。
循环播放列表
为实现长时间无人直播,V2.3版本核心更新是增加了视频播放列表功能。此前版本仅支持播放单个视频文件,若要实现24小时直播,单个视频文件会过于庞大,不利于加载。新功能允许将一个大视频切分成多个数小时的小文件,通过右键菜单“加入清单”,系统将按顺序循环播放列表中的所有内容,极大提升了直播的稳定性和灵活性。
摄像头画面校正
针对部分用户遇到的摄像头画面非正向问题,新版增加了四项调整选项。这包括左右镜像、上下颠倒、左转90度和右转90度。这些设置覆盖了常见的摄像头摆放角度和安装错误,用户可根据实际画面情况一键选择,确保数字人形象始终以正确方向呈现,解决了设备兼容性的困扰。
提升对话准确性
在数字人对话方面,此次更新对语音识别模型进行了优化。开发团队移除了两个较小的、容易产生“幻觉”的模型,这些模型常导致输出一些奇怪的、与问题无关的内容。通过精简模型并屏蔽部分异常输出,数字人对话的准确度和逻辑性得到增强,交互体验更加可靠。
SynthTalker V2.3的更新聚焦于解决实际应用中的障碍,尤其是对24小时无人直播的支持,体现了工具的实用性提升。这些细节优化能否满足更复杂的直播场景需求,值得进一步探索。