数字人

Open Avatar Chat

Open Avatar Chat是阿里开源的模块化实时数字人对话系统,支持低延迟交互与多模态输入输出。系统采用模块化架构,允许灵活配置语音识别、语言模型和语音合成等组件,兼容本地与云服务。支持2D/3D数字人渲染,适用于客户服务、教育、娱乐及企业应用等多个场景,为开发者提供高效、灵活的AI对话解决方案。

灵感岛

灵感岛是一款结合AI技术的内容创作与智能营销平台,专注于为自媒体创作者及品牌营销团队提供全方位的支持。它具备智能文案生成、视频脚本创作、智能混剪、数字人直播等多项核心功能,覆盖内容生产的全流程,并支持多平台分发与效果追踪,帮助企业实现内容营销的降本增效。

厘里AI数字人

阿里大文娱技术团队自研的AI数字人,不仅是国内首部文生视频AI系列动画片和电视剧中的应用,也标志着数字人在影视内容创作中的巨大潜力。

小云雀APP

剪映推出的一款视频和图片创作工具,它能通过简单的指令快速生成短视频、数字人口播视频、设计图和换背景图,具备智能成片、数字人视频、AI设计和AI换背景四大功能。

MoCha

MoCha 是一款由 Meta 与滑铁卢大学联合开发的端到端对话角色视频生成模型,支持语音与文本驱动的角色动画生成,具备全身动作模拟与多角色对话交互能力。其核心技术包括扩散变压器架构和语音-视频窗口注意力机制,确保动画与语音精准同步。适用于虚拟主播、影视动画、教育内容及数字人客服等多个领域,提升了内容创作效率与表现力。

Edimakor

Edimakor是一款基于AI技术的视频编辑工具,具备AI字幕翻译、智能脚本生成、文字转语音、AI视频生成等多种功能,大幅简化视频制作流程,提升工作效率。它适用于内容创作者、教育机构、企业宣传等多个领域,支持多语言字幕翻译与配音,助力全球化传播。

PoseTalk

PoseTalk 是一款基于文本和音频驱动的开源工具,专注于生成自然且逼真的头部动画视频。它通过 Pose Latent Diffusion (PLD) 模型和级联网络实现唇部同步与运动细化,广泛应用于虚拟助手、在线教育和娱乐等领域,提供多样化的动画生成能力和高度精准的唇形同步效果。

SadTalker

SadTalker是一个由西安交通大学、腾讯AI实验室和蚂蚁集团合作开发的开源AI数字人项目。该工具利用单张人脸图像和语音音频,通过3D运动系数生成逼真的说话人脸动画。它通过ExpNet精确学习面部表情,PoseVAE合成不同风格的头部运动,并采用3D面部渲染技术,实现高质量、风格化的视频动画。SadTalker还具备多语言支持和多模态学习能力,适用于虚拟助手、视频制作、语言学习、社交媒体和教育等

慧播星

慧播星是百度推出的电商数字人直播平台,该平台允许用户快速生成数字人主播,自动创建直播剧本和互动文案,并智能装修直播间,以此显著提升直播的互动性和转化率。