讯飞虚拟人是科大讯飞提供的虚拟人产品服务,运用AI虚拟形象技术,并结合语音识别、语义理解、语音合成、自然语言处理和星火大模型等技术,面向虚拟人形象资产构建、AI驱动和多模态交互等需求,提供从数字资产定制、音视频内容制作到交互能力接入的服务。产品既覆盖虚拟“AI演播室”这类内容生产场景,也提供智能交互机、终端SDK、服务端API、公有云API和私有化部署方案,适用于新闻媒体、金融、文旅、政务、教育、企业应用、赛事活动等场景。
核心功能
虚拟人音视频内容生产
虚拟“AI演播室”支持输入文本或录音,完成音频、视频作品输出。官网将其定位为一站式虚拟人音视频内容生产工具,AIGC用于辅助创作,页面说明可在3分钟内渲染出稿。该能力可用于把文字内容转化为虚拟人播报音视频,减少人工主播录制和播报环节。
真人形象克隆
真人形象克隆支持录制5分钟视频,制作1:1真人虚拟数字分身。生成的分身可以通过输入文本进行AI驱动,输出虚拟人视频,用于替代真人出镜的多种应用场景。官网展示了甜美讲解、新闻播报、朋友闲聊、英文播报和广告宣传等内容类型,并标注可使用原声或克隆声音。
声音复刻
声音复刻支持录制5分钟音频,用于复刻1:1真人音色和音律。完成复刻后,可通过输入文本生成本人复刻音频,用于替代真人发音,让AI代替用户进行声音表达。该能力与真人形象克隆分别提供音频和视频方向的个性化资产定制。
3D形象定制
3D形象定制支持超写实、卡通、美型等多种3D形象风格。用户可以进行个性化换装和动作搭配,也可以通过DIY捏脸完成多维度模型调整。官网将形象定制、声音复刻和真人数字分身并列为虚拟人资产定制服务,可根据不同场景构建相应的虚拟人形象。
智能交互机
智能交互机以大屏交互一体机终端为载体,实现用户与虚拟人物形象之间的面对面互动交流。该产品可用于业务咨询、智能问答和服务导览等交互场景,官网列举的应用领域包括金融、文旅、政企和商业。它将虚拟人物形象与业务服务场景结合,面向需要现场交互的业务使用方式。
虚拟人能力开放与集成
针对有虚拟人应用搭建和集成需求的客户,讯飞虚拟人提供终端SDK、服务端API、公有云API和私有化部署等接入方案。相关能力可以集成到APP、Web和小程序等产品形态中,适合将虚拟人能力接入既有产品或业务系统。官网同时将形象克隆、声音复刻、3D定制、内容生产和虚拟直播列为可合作的虚拟数字人能力。
使用方式
内容生产场景可以在虚拟“AI演播室”中输入文本或录音,生成音视频作品;真人形象克隆和声音复刻则分别需要录制5分钟视频或5分钟音频。对于应用集成,官网提供终端SDK、服务端API、公有云API和私有化部署,并支持接入APP、Web和小程序。正文未说明是否需要注册,也未说明是否需要自备模型Key。
适用人群与场景
新闻媒体可使用虚拟主播将文字直接生成音视频,用于紧急突发新闻和高频更新内容的播报。金融、文旅、政企和商业机构可使用智能交互机开展业务咨询、智能问答和服务导览。企业应用、教育培训、赛事活动等场景可以使用虚拟人资产、内容生产或能力接入服务。需要真人数字分身、专属声音或3D形象的客户,则可选择形象克隆、声音复刻和3D定制服务。
注意事项
官网说明,真人形象克隆和声音复刻分别需要录制5分钟视频或音频;虚拟“AI演播室”的页面说明为3分钟内渲染出稿。正文未提供具体价格、免费额度或套餐信息,也未说明注册要求和数据处理规则。