跳到主要内容
项目详情

ARC是腾讯ARC实验室面向人工智能前沿研究与产业应用建设的成果展示平台。腾讯ARC实验室以“探索和挑战前沿技术”为使命,围绕3D生成与重建、视频生成与控制、视觉基础任务、图像生成与编辑、视频理解等方向展示研究成果。平台不仅呈现模型和论文,也介绍成果在腾讯实际业务及外部业务中的落地情况,并通过开源项目为全球社区提供工具与基准。

核心功能

3D生成与重建

InstantMesh是页面展示的3D生成与重建成果,属于高效的前馈式3D网格生成框架。它能够利用单张图片,在数秒内生成高质量的3D模型,适用于从二维图像获得三维模型的研究与应用场景。页面同时提供论文查看入口,便于了解该成果的研究内容。

视频生成与控制

ToonComposer基于关键帧和线稿进行动漫视频插帧,通过单个模型完成补间与插帧的一体化处理。该模型面向动漫创作中的视频生成与控制任务,页面将其描述为能够大幅度提高动漫创作效率的研究成果。ViewCrafter则可以对任意图片进行运镜拍摄静态场景,并生成对应的视频结果。

图像生成与编辑

IC-Custom是图像定制化模型,给定参考图后生成与参考图ID一致的图像。PhotoMaker面向个性化文生图,可以接收任意数量的人脸照片,并结合文本提示,在几秒内生成高保真、风格多样的定制人物图像。BrushNet用于文本引导图像编辑,通过基于笔刷的掩码机制,让用户更灵活、精细地控制扩散模型的编辑区域。

视频基础任务与视频理解

DepthCrafter是视频深度估计模型,强调时序稳定和细节丰富,并支持开放世界视频。ARC-Hunyuan-Video-7B针对真实世界的视频理解任务设计,支持横屏和竖屏视频的结构化理解,页面还展示了其视频描述总结能力在同量级模型中的表现。相关成果覆盖视频深度估计、视频结构化理解和视频描述总结等任务。

论文、开源项目与成果落地

ARC页面集中展示研究论文、开源项目和实际业务落地成果。官网介绍,实验室自2019年起在CVPR、ICCV等顶级会议与期刊上发表论文160余篇,并将GFPGAN、YOLO-World、VideoCrafter、SEED-Bench、DepthCrafter等核心成果开源。研究成果还依托腾讯业务场景落地于腾讯实际业务或授权于外部业务,页面列出的落地业务包括QQ、QQ空间、腾讯视频、微视、腾讯新闻和QQ浏览器等。

使用方式

ARC以网页研究成果展示为主要形式,用户可以从“更多研究”进入研究内容,也可以查看各模型的论文入口。部分成果页面提供AI应用链接,例如yolo-world、DepthCrafter和ARC-Hunyuan-Video-7B对应的页面。官网正文未说明注册要求、客户端、浏览器插件、API调用方式或模型Key配置;页面明确展示了论文、模型介绍和开源项目等内容。

适用人群与场景

人工智能研究人员可以通过ARC了解3D生成、视频理解、图像编辑等方向的论文与模型成果。需要开展视觉算法开发的工程团队,可以关注InstantMesh、DepthCrafter、BrushNet等模型及其对应任务。动漫和视频创作者可参考ToonComposer的关键帧、线稿插帧能力,以及ViewCrafter的静态场景运镜生成能力。关注人工智能产业化的企业或合作方,则可以查看腾讯视频、QQ、微视等技术落地案例与商务合作入口。

3D模型生成InstantMesh能够利用单张图片在数秒内生成高质量的3D模型。
动漫视频插帧ToonComposer基于关键帧和线稿,通过单个模型完成动漫视频补间与插帧。
个性化图像生成PhotoMaker接收任意数量的人脸照片并结合文本提示,生成定制人物图像。
视频深度估计DepthCrafter支持开放世界视频,并具备时序稳定、细节丰富的特性。
文本引导图像编辑BrushNet通过基于笔刷的掩码机制控制扩散模型的图像编辑区域。

用户评论 (0)

还没有用户评论

成为第一个分享使用体验的人

查看更多

ARC 截图

官网首页截图

写评论

分享你的使用体验,至少 10 个字。评论可以发多条,打分在右侧卡片单独进行。

还需 10 个字 · 0 / 500