跳到主要内容
项目详情

讯飞虚拟人是科大讯飞提供的虚拟人产品服务,运用AI虚拟形象技术,并结合语音识别、语义理解、语音合成、自然语言处理和星火大模型等技术,面向虚拟人形象资产构建、AI驱动和多模态交互等需求,提供从数字资产定制、音视频内容制作到交互能力接入的服务。产品既覆盖虚拟“AI演播室”这类内容生产场景,也提供智能交互机、终端SDK、服务端API、公有云API和私有化部署方案,适用于新闻媒体、金融、文旅、政务、教育、企业应用、赛事活动等场景。

核心功能

虚拟人音视频内容生产

虚拟“AI演播室”支持输入文本或录音,完成音频、视频作品输出。官网将其定位为一站式虚拟人音视频内容生产工具,AIGC用于辅助创作,页面说明可在3分钟内渲染出稿。该能力可用于把文字内容转化为虚拟人播报音视频,减少人工主播录制和播报环节。

真人形象克隆

真人形象克隆支持录制5分钟视频,制作1:1真人虚拟数字分身。生成的分身可以通过输入文本进行AI驱动,输出虚拟人视频,用于替代真人出镜的多种应用场景。官网展示了甜美讲解、新闻播报、朋友闲聊、英文播报和广告宣传等内容类型,并标注可使用原声或克隆声音。

声音复刻

声音复刻支持录制5分钟音频,用于复刻1:1真人音色和音律。完成复刻后,可通过输入文本生成本人复刻音频,用于替代真人发音,让AI代替用户进行声音表达。该能力与真人形象克隆分别提供音频和视频方向的个性化资产定制。

3D形象定制

3D形象定制支持超写实、卡通、美型等多种3D形象风格。用户可以进行个性化换装和动作搭配,也可以通过DIY捏脸完成多维度模型调整。官网将形象定制、声音复刻和真人数字分身并列为虚拟人资产定制服务,可根据不同场景构建相应的虚拟人形象。

智能交互机

智能交互机以大屏交互一体机终端为载体,实现用户与虚拟人物形象之间的面对面互动交流。该产品可用于业务咨询、智能问答和服务导览等交互场景,官网列举的应用领域包括金融、文旅、政企和商业。它将虚拟人物形象与业务服务场景结合,面向需要现场交互的业务使用方式。

虚拟人能力开放与集成

针对有虚拟人应用搭建和集成需求的客户,讯飞虚拟人提供终端SDK、服务端API、公有云API和私有化部署等接入方案。相关能力可以集成到APP、Web和小程序等产品形态中,适合将虚拟人能力接入既有产品或业务系统。官网同时将形象克隆、声音复刻、3D定制、内容生产和虚拟直播列为可合作的虚拟数字人能力。

使用方式

内容生产场景可以在虚拟“AI演播室”中输入文本或录音,生成音视频作品;真人形象克隆和声音复刻则分别需要录制5分钟视频或5分钟音频。对于应用集成,官网提供终端SDK、服务端API、公有云API和私有化部署,并支持接入APP、Web和小程序。正文未说明是否需要注册,也未说明是否需要自备模型Key。

适用人群与场景

新闻媒体可使用虚拟主播将文字直接生成音视频,用于紧急突发新闻和高频更新内容的播报。金融、文旅、政企和商业机构可使用智能交互机开展业务咨询、智能问答和服务导览。企业应用、教育培训、赛事活动等场景可以使用虚拟人资产、内容生产或能力接入服务。需要真人数字分身、专属声音或3D形象的客户,则可选择形象克隆、声音复刻和3D定制服务。

注意事项

官网说明,真人形象克隆和声音复刻分别需要录制5分钟视频或音频;虚拟“AI演播室”的页面说明为3分钟内渲染出稿。正文未提供具体价格、免费额度或套餐信息,也未说明注册要求和数据处理规则。

虚拟人音视频生产在虚拟AI演播室输入文本或录音,一键输出音视频作品。
真人形象克隆录制5分钟视频即可制作1:1真人虚拟数字分身,并通过文本驱动生成视频。
声音复刻录制5分钟音频复刻1:1真人音色和音律,再输入文本生成复刻音频。
3D形象定制支持超写实、卡通、美型风格,以及换装、动作搭配和DIY捏脸。
多端能力接入提供终端SDK、服务端API、公有云API和私有化部署,支持集成到APP、Web和小程序。

用户评论 (0)

还没有用户评论

成为第一个分享使用体验的人

查看更多

讯飞虚拟人 截图

官网首页截图

写评论

分享你的使用体验,至少 10 个字。评论可以发多条,打分在右侧卡片单独进行。

还需 10 个字 · 0 / 500