Resemble AI 是面向企业的多模态深度伪造检测平台,提供音频、图像、视频和文本相关的检测模型,用于识别 AI 生成内容、验证身份、预防欺诈和审查用户生成内容。官网将其定位为可在深伪出现的各种场景中使用的检测方案,既能接入现有工作流和电话、会议等系统,也能通过 REST API 调用。与只返回真假结论的工具不同,Resemble AI 强调实时检测、确定性评分、可解释结果和可审计输出,并提供本地部署、隔离网络部署及零保留模式,面向对数据安全、合规和可复现性有要求的企业与机构。
核心功能
DETECT-World 多模态检测
DETECT-World 用于检测 AI 生成的音频、视频和图像。官网介绍其结合模式匹配、训练方法与 world model 架构,通过识别偏离物理现实的特征来判断内容是否为深伪。输出包括确定性分数、判定结果以及面向人的可读结果;官网列出的模型准确率为音频 99.5%、视频 98%、图像 96%。
三代检测模型
平台覆盖音频、图像和视频检测能力,官网说明音频能力存在于全部版本,图像和视频能力在 DETECT-3B Omni 中推出。相关基准说明中,音频采用 Podonos benchmark,图像和视频使用内部测试,外部测试正在进行。用户可以根据音频、图像或视频内容选择相应的检测能力。
Intelligence 可解释分析
Intelligence 为确定性检测分数和结果提供人类可读的解释。其输出被描述为可审计、结构化且便于人理解的结果,适合需要留存判断依据、复核检测过程或生成证据材料的场景。官网还将其与检测文档单独列出,说明该能力可作为检测流程中的分析层使用。
Signal 欺诈模式告警
Signal 会在内容匹配已知欺诈模式时向用户发出提醒,并且官网明确写出该能力无需录制内容。其输出为合规的告警与通知,以及人类可读的结果;同时支持库定制,可用于电话基础设施、客户服务流程或其他需要在事件结束前触发提醒的系统。
Identity 身份匹配
Identity 支持录入并检测声音和 likeness,用于身份匹配。系统输出确定性分数、判定结果和人类可读结果,可用于 KYC 与账户开户流程,在允许个人进入系统前进行验证,也可用于高管与品牌保护等身份冒用检测场景。
PerTh Multimodal 水印
PerTh Multimodal 提供不可感知的多模态水印。官网列出的输出包括符合 EU AI Act 的文件、确定性分数和判定结果,以及人类可读结果。该能力与深伪检测模型并列,适合需要为文件加入不可见标识并保留确定性验证结果的内容流程。
使用方式
官网提供 Web 应用入口,可通过“Try latest model”或“Get started”进入 app.resemble.ai;会议保护场景标注为“Try it free”。平台支持接入现有工作流、通过 integrations 使用,也提供 Via API 的调用方式。开发者可以安装 resemble Python 包,设置 API key 后调用 deepfake_detection.detect_and_get 分析文件,并读取返回的 metrics。企业还可使用单一 REST API 接入 SIEM、SOAR 和身份平台。官网未说明注册要求、导入导出格式或 API 的具体额度。
适用人群与场景
客户联络中心可把检测直接接入运营商呼叫基础设施,在通话结束前获得实时告警,用于识别接触中心欺诈。会议平台和企业 IT 团队可在主流会议平台上实时检测合成声音与人脸。执法机构可用于法证分析,生成适用于法庭且可复现的报告;金融、互联网平台和品牌团队则可将其用于 KYC、账户开户、文档与收据防伪、社交内容审核,以及发现冒充高管或品牌的内容。
定价
官网正文没有列出价格、套餐或具体免费额度,仅在会议保护入口使用“Try it free”表述,并提供获取 API key 的入口。因此,正文只能确认存在可免费试用的入口,无法确认试用范围或后续收费方式。
注意事项
官网列出的安全与部署能力包括 GDPR、ISO 27001、SOC 2 Type II 和 HIPAA 相关说明。企业可采用完全容器化的本地安装,并在 air-gapped 环境中运行,不建立外部连接;零保留模式会在检测后永久删除媒体,不进行保留或重新分析。检测准确率和基准数字来自官网不同区块,具体模型、测试条件和数据来源应以对应基准说明为准。官网同时提供深度伪造事件数据库,其中包含性化深伪、身份冒用和诈骗等敏感案例。