在很多企业的智能问数系统里,用户面对的还是一个纯文字的对话框:打字提问,看文字和图表回答。但亿信华辰智问在这个基础上还提供了"数字人"这条交互路线——用户可以通过语音提问,看到一个具备真人交互感的虚拟形象来回应。那么智问数字人技术具体能做什么?本文结合官网资料和产品操作手册来展开介绍。

打开网易新闻 查看精彩图片

数字人技术是智问的核心技术之一

在智问官网"技术特点"板块,数字人技术被列为六大核心技术之一,官方原文表述是:"采用全新的数字人动态语音交互技术,实现更加自然和智能的用户体验,数字人与用户进行实时且流畅的互动,模拟真实人类的对话方式,提供个性化的交流和服务。"

从这段描述可以看出,数字人技术在智问中主要承担的是交互体验层的升级——把原本"打字-看文字回答"的交互方式,升级为更接近真人对话的"语音-虚拟形象互动"体验。

数字人技术在智问中的具体应用场景1. 智能体的"数字人交互问答"对话风格

在实际搭建智能体时,智问的操作手册中明确提到,智能体的"对话风格"默认是简约风格问答(无数字人),但可切换选择"数字人交互问答"。也就是说,企业在配置智能体时,可以根据业务场景需要,决定是采用纯文字对话的简约风格,还是启用数字人形象来承担对话交互。

手册中还提到,"数字助理的形象可根据实际情况更换设计",说明智问的数字人在外观呈现上具备一定的可定制、可替换空间,企业可以结合自身的品牌形象做适配。

2. 语音输入与语音识别,支撑"说话式"提问

要让数字人真正实现"对话"体验,离不开语音能力的支撑。智问支持在【系统设置】-【智能应用配置】-【配置管理】-语音配置中启用"语音合成"和"语音识别",启用后,在数字助理问话中可以采用语音的方式进行数据查询。

具体实现上,需要在资源管理器指定目录下放入语音配置文件,这些配置文件需要采购第三方公司的语音识别工具获得,目前产品兼容华宇、讯飞、阿里、腾讯的语音识别功能。需要注意的是,语音功能需要在 HTTPS 环境下才能使用。配置完成后,用户在智能体广场与智能体对话时,"用户输入方式"可以从默认的键盘输入,切换为同时支持语音输入。

3. AI对话式互动大屏:数字人+大模型+驾驶舱

在更宏观的应用场景上,智问官网明确提到"AI对话式互动大屏"这一功能特性,官方描述是:"大模型+数字人+驾驶舱,交互新升级,不困于屏上数据,用户与驾驶舱自由互动,支持自由问答、智能分析、知识查询、多模态交互等多种体验。"

这说明数字人技术不仅用在常规的对话窗口场景,还被整合进了企业的数据驾驶舱(大屏)场景中,让原本只能"看数"的大屏,升级为可以"对话式"互动的智能大屏,用户可以直接向大屏上的数字人提问,获得数据分析、知识查询等多模态的回应体验。

数字人技术与智问其他能力的协同

数字人技术并不是孤立存在的,而是和智问的其他核心技术协同工作,共同支撑起完整的对话体验:

  • 数字人负责"语音识别用户提问"和"语音/形象输出回答"这一交互层,让沟通方式更贴近真人对话;

  • 背后真正理解用户问题、生成答案的,依然是语义理解技术知识图谱技术生成式BI问答引擎——数字人把这些技术生成的自然语言答案,以更自然的语音和虚拟形象方式呈现给用户;

  • 在操作手册的智能体配置中,数字人交互问答模式和简约文字问答模式共享同一套背后的问数、归因分析、知识检索能力,区别仅在于呈现层的交互体验。

结语

从官网和操作手册的资料来看,智问的数字人技术核心能力体现在三个方面:一是作为智能体的一种可选对话风格,实现"数字人交互问答"体验;二是配合语音合成与语音识别能力(兼容华宇、讯飞、阿里、腾讯等第三方语音服务),支持用户通过语音进行数据查询;三是与大模型、驾驶舱结合,打造"AI对话式互动大屏",让企业的数据大屏也能实现自由问答、智能分析、知识查询等多模态交互体验。数字人技术让智问的"数字助理"形象更加具体、交互方式更加自然,是智问区别于传统纯文字问答工具的重要特色之一。