SadTalker

SadTalker

SadTalker 是由西安交通大学(西交大)开源的项目。它是一个用于生成风格化的单图说话人脸动画的工具,可以根据输入的图片和音频生成对应音频口型的视频。用户可以给模型一张图片以及一段音频文件,模型会根据音频文件把传递的图片进行人脸的相应动作,比如张嘴、眨眼、移动头部等。它可以从音频中生成3DMM的3D运动系数(头部姿势、表情),并隐式调制一种新颖的3D感知面部渲染,用于生成说话的头部运动视频。
060
EchoMimic

EchoMimic

EchoMimic是阿里巴巴达摩院开发的一项AI数字人开源项目,能够通过音频和面部标志点生成高度逼真的肖像动画。无论是单独使用音频或面部标志点,还是将两者结合,EchoMimic都能创造出自然流畅的动态视频。能够通过给定的音频和一张面部照片,生成与音频口型动作匹配的说话或者唱歌视频,做口播视频或者趣味唱歌视频都可以。该技术在娱乐、教育、虚拟现实和在线会议等领域有广泛应用前景。
080
AI Studios

AI Studios

AI Studios 提供了一个基于AI数字人的文本生成视频的平台。用户可以输入或上传文本、PPT文件,快速生成逼真的AI视频。这个平台支持多种语言和场景,还可以选择不同的背景音乐和AI数字人,以及编辑字幕和配音。AI Studios可以用于制作培训视频、营销视频、解说视频、新闻视频等各种场景。此外,它还提供了超过80种语言的文本转语音服务和100多种逼真的AI声音,以及500多种视频模板,以满足不同的视频制作需求。
0110
百度智能云曦灵

百度智能云曦灵

百度智能云曦灵是百度推出的数字人直播平台,拥有创新且成熟的3D高精模拟真人技术。在曦灵平台上传一张照片,就能快速生成一个可被AI驱动的2D数字人像。同时,通过一句话语音描述或简单捏脸等多种形式,可以快速生产数字人。该平台适用于广电、互娱、金融、政务、运营商、零售等行业,可以为用户提供一站式的虚拟主持人、虚拟员工、虚拟偶像、品牌代言人的创建与运营服务。
070
HelloMeme

HelloMeme

HelloMeme 是一个专注于生成高保真图像和视频内容的 AI 项目,特别是表情克隆技术。通过采用最新的 SD1.5 架构和空间编织注意力扩散模型,HelloMeme 可以轻松将一张图片的表情迁移到另一张图片或视频上,生成效果超越同类工具如 Liveportrait。HelloMeme 支持 ComfyUI 界面操作,非常适用于 AI 数字人、表情包制作和照片复活等领域,带来更自然细腻的表情效果。
040
美图数字人开放平台

美图数字人开放平台

美图数字人开放平台是美图公司旗下的一个专注于3D数字人制作、AI人像驱动、AIGC内容制作以及AI人机交互的服务平台。通过美图数字人开放平台,用户可以轻松创建具有高度个性化的数字人形象,并应用于各种场景和领域,如影视制作、虚拟客服、品牌代言等。该平台提供一系列的服务,旨在帮助客户打造品牌化的、独立的数字人IP,从而吸引更多的年轻客群。
0110
司马诸葛

司马诸葛

司马诸葛是一个基于自研文档智能模型(DocMind)+大语言模型技术的企业级AI数字员工平台(AI Agent),帮助企业加速AI场景的落地。企业无需复杂设置,通过企业知识文档,就可训练专属AI数字员工,提供7*24小时在线服务,解决企业内外部的知识问答、专业文档分析、内容再创作等任务。适用于AI客服、AI人事、AI法务、AI销售顾问等多个场景,提升企业效率和客户体验。
050
司马诸葛

司马诸葛

司马诸葛是一个基于自研文档智能模型(DocMind)+大语言模型技术的企业级AI数字员工平台(AI Agent),帮助企业加速AI场景的落地。企业无需复杂设置,通过企业知识文档,就可训练专属AI数字员工,提供7*24小时在线服务,解决企业内外部的知识问答、专业文档分析、内容再创作等任务。适用于AI客服、AI人事、AI法务、AI销售顾问等多个场景,提升企业效率和客户体验。
090
AigcPanel

AigcPanel

AigcPanel是一款免费开源、简单易用的一站式AI数字人系统。支持视频合成、声音合成、声音克隆,简化本地模型管理用户可以一键导入和使用AI模型。最大的优势在于通过一个安装包即可完成所有环境配置,实现"开箱即用",使用户可以轻松地在Windows和Mac环境下操作。无论是生成高质量的视频,还是个性化的语音克隆,AigcPanel 都能满足您的需求。
0130
怪兽AI数字人

怪兽AI数字人

怪兽AI数字人为怪兽智能科技推出的产品,包含全息交互数字人、3D超写实交互数字人,AIGC生产、SaaS管理和直播服务平台。创始团队来自怪兽智能大数据平台,在互联网、物联网、智能软硬件等领域积累了丰富的行业经验,致力于打造全球领先的AIGC数字人智能平台。通过真人形象克隆、真人声音克隆、孪生姿态合成、唇形同步驱动、实时视频渲染、多素材集成人工智能等核心技术及模块式交付SAAS及应用软件系统,帮助客户实现数字人的短视频内容生产创作及直播宣传。怪兽AI为品牌商家及本地生活商家提供数字人克隆、数字人短视频生成、数字人直播解决方案、3D超写实全息交互屏及数字人交互解决方案。
060
怪兽AI数字人

怪兽AI数字人

怪兽AI数字人为怪兽智能科技推出的产品,包含全息交互数字人、3D超写实交互数字人,AIGC生产、SaaS短视频创作管理和直播服务平台。创始团队来自怪兽智能大数据平台,在互联网、物联网、智能软硬件等领域积累了丰富的行业经验,致力于打造全球领先的AIGC数字人智能平台。通过真人形象克隆、真人声音克隆、孪生姿态合成、唇形同步驱动、实时视频渲染、多素材集成人工智能等核心技术及模块式交付SAAS及应用软件系统,帮助客户实现数字人的短视频内容生产创作及直播宣传。怪兽AI为品牌商家及本地生活商家提供数字人克隆、数字人短视频生成、数字人直播解决方案、3D超写实全息交互屏及数字人交互解决方案。
070
MuseV

MuseV

MuseV是一个由腾讯音乐娱乐旗下的天琴实验室推出的基于SD扩散模型的高保真虚拟人视频生成框架。支持文生视频、图生视频、视频生视频等多种生成方式,能够保持角色一致性,且不受视频长度限制。这意味着用户可以通过MuseV轻松地将文本、图像或现有视频转换成高质量的虚拟人视频,无需担心角色形象的不统一或视频时长的限制。
0150