VAS 是一款面向视频字幕处理的 Windows 客户端工具,主要用于从视频中提取人声并生成外挂字幕、翻译字幕以及对字幕结果进行编辑。它支持大模型翻译、机器翻译、GPU 加速、人声分离、多文件上传、任务队列和断点续传,字幕生成后可以继续调整时间与内容。官网还明确说明,一切操作均在本地完成,无需上传云端;软件最低配置要求为 Windows 64 位系统、8G 以上内存和 Windows 10 及以上系统。
核心功能
自动生成外挂字幕
上传视频后,可以选择视频源语言和想要生成的字幕语言,一键自动生成字幕,并生成外挂字幕文件。该功能支持 VR 场景,适合需要为视频制作独立字幕文件的使用方式。
大模型翻译与字幕翻译
VAS 提供大模型翻译能力,并结合上下文场景处理字幕内容。官网将其描述为能够提升字幕翻译准确率;同时,价格说明中区分了机器翻译和大模型翻译,两种方式会按照不同的时长规则扣除余额。
GPU 加速
软件支持 N 卡和 A 卡进行 GPU 加速。官网给出的示例是使用 3060 显卡处理 1 小时视频,完成时间为 10 分钟。GPU 加速适用于需要处理较长视频或批量处理视频的场景。
人声分离与智能增强
对于存在持续噪音的音视频,可以使用人声分离功能提取人声。官网还提供智能增强算法,并将其描述为针对字幕精准度的优化方案;这些功能用于配合字幕提取和生成过程。
字幕编辑
字幕翻译结果可以进行二次编辑,编辑内容包括字幕时间和字幕文字。生成字幕后,用户可以根据视频内容对时间轴和具体文本进行调整,而不是只能直接使用初始翻译结果。
多任务队列与断点续传
软件支持一次性批量上传多个视频,任务会进入队列并按顺序自动执行。字幕提取进度会实时保存,关闭客户端后进度不会丢失,之后可以继续运行未完成的任务。
使用方式
VAS 提供 Windows 客户端下载,包括在线安装版本和免安装的完整压缩包版本。使用时需要满足 Windows 64 位、内存 8G 以上和 Windows 10 及以上的最低配置要求。用户上传视频后选择源语言和目标字幕语言即可生成字幕,也可以对字幕时间和内容进行二次编辑。官网未提及浏览器端、移动端、命令行或开放 API,也未说明需要用户自行准备模型 Key。
适用人群与场景
需要为视频制作字幕的用户,可以使用 VAS 从视频中生成外挂字幕,并选择源语言和目标语言。需要翻译视频字幕的用户,可以使用机器翻译或大模型翻译,再对时间和内容进行调整。处理带有持续噪音的音视频时,可以使用人声分离提取人声。需要连续处理多个视频的用户,可以通过多任务队列批量上传;处理时间较长或中途需要关闭软件时,可以利用断点续传保留进度。
定价
VAS 提供按余额时长计费的方案。99 元可增加 13200 分钟余额,29 元可增加 3600 分钟余额;机器翻译按视频时长 1:1 扣费,大模型翻译按视频时长 2 倍扣费,购买的时长不会过期。官网还提供限时免费方式:观看一次激励视频可增加 1 小时余额,每天最多观看 10 次,获得的时长不会过期。
注意事项
VAS 的最低配置要求为 Windows 64 位系统、8G 以上内存和 Windows 10 及以上系统。GPU 加速部分支持 N 卡和 A 卡。官网说明所有操作均在本地完成,无需上传云端;同时,机器翻译和大模型翻译会按照不同的余额扣费规则消耗时长。