跳到主要内容
项目详情

EasyVoice 是一套面向小说文本的语音生成解决方案,用于将文本转换为自然流畅的语音。它支持处理大型文本文件,能够为不同角色配置具有差异的声音,并在正式生成前试听语音效果。除语速、音调等常规参数外,EasyVoice 还支持接入自定义大模型和 TTS 服务;官网同时提供了使用 Docker 或 Node.js 部署自己实例的方式,适合需要把超长小说转成音频、希望区分多角色声音,或需要自行部署语音生成服务的使用者。

核心功能

超长小说转换

EasyVoice 支持处理大型文本文件,可将超长小说转换为语音。官方将这一能力描述为“一键转换”,使用者不需要把产品用途限定在短文本或单段内容上。生成结果是由文本转换而来的语音内容,具体生成速度会受到网络状况、语音服务以及配音方式影响。

多角色配音

产品支持为小说中的不同角色配置不同声音。可选的语音角色覆盖多种语言、性别和角色特性,从而为不同角色赋予独特声音。生成页面可以选择语音角色,也可以调整相关参数;如果使用 AI 智能推荐,系统会根据不同段落决定配音参数。

语音试听

在生成最终语音之前,可以先试听语音效果。这个步骤用于确认当前声音配置是否符合预期,再决定是否生成最终结果。试听功能可以和语音角色、语速、音调等设置配合使用。

语速与音调设置

EasyVoice 提供自定义设置,可调整生成语音的语速和音调。使用者可以在生成页面修改这些参数,也可以通过 AI 智能推荐获得相应配置。官网还提到,使用 Edge-TTS 时可以选择固定的声音进行配音。

自定义模型与 TTS 服务

EasyVoice 支持接入自定义大模型和 TTS 服务。AI 推荐配音会让大模型分析文本分段,并推荐各分段的配音参数;大模型的能力会直接影响配音结果。除更换不同大模型外,也可以使用 Edge-TTS 选择固定声音,以改变配音方式。

使用方式

官网介绍了生成页面中的基本操作:选择语音角色,调整语速和音调,或使用 AI 智能推荐配置,然后试听语音效果并生成结果。部署方面,使用者可以按照官方部署文档,通过 Docker 或 Node.js 快速部署自己的 EasyVoice 实例。长文本生成依赖网络请求,Edge-TTS 的并发参数可在 .env 文件中调整,参数名为 EDGE_API_LIMIT,官方提示该值应低于 10。

适用人群与场景

需要将超长小说转换为语音的使用者,可以利用大型文本文件处理和一键转换能力生成音频。需要制作有角色区分的小说配音时,可以为不同角色选择不同语言、性别和角色特性的声音。希望在生成前确认效果的人,可以先试听并调整语速、音调。需要自行掌控部署环境或接入自定义模型、TTS 服务的使用者,则可以部署自己的 EasyVoice 实例并进行相关配置。

注意事项

AI 推荐配音的效果取决于大模型能力,配音效果不理想时,官网建议更换大模型,或使用 Edge-TTS 配置固定声音。Edge-TTS 依赖网络请求生成音频;AI 推荐配音还需要先对文本分段、分析并推荐参数,再生成和拼接音频,因此速度会比直接使用 Edge-TTS 慢。提高并发可能受到限制,调整 EDGE_API_LIMIT 时需要注意并发过高的情况。

超长文本转换支持处理大型文本文件,将超长小说转换为语音。
多角色配音支持多种语言、性别和角色特性的语音,为不同角色配置独特声音。
生成前试听生成前可以试听语音效果,确认结果是否符合预期。
自定义语音参数支持调整语速、音调,并可通过 AI 推荐配置配音参数。
自定义部署与服务支持接入自定义大模型和 TTS 服务,并可使用 Docker 或 Node.js 部署实例。

用户评论 (0)

还没有用户评论

成为第一个分享使用体验的人

查看更多

EasyVoice 截图

官网首页截图

写评论

分享你的使用体验,至少 10 个字。评论可以发多条,打分在右侧卡片单独进行。

还需 10 个字 · 0 / 500