视频

MusicMint

MusicMint 是一款基于人工智能的音乐创作工具,支持多种音乐风格并提供高度自定义选项,如乐器、情绪、主题和结构等。用户可通过简单描述或选择参数快速生成原创音乐,并支持下载与分享。适用于个人创作、视频配乐、MV 制作及艺术项目等多种场景,是音乐爱好者和创作者的理想工具。

EMO2

EMO2是一种由阿里巴巴智能计算研究院开发的音频驱动头像视频生成技术,通过音频输入和静态人像照片生成高质量、富有表现力的动态视频。其核心技术包括音频与手部动作的协同建模、扩散模型生成视频帧,以及高精度音频同步。该工具支持多样化动作生成,适用于虚拟现实、动画制作和跨语言内容创作等场景,具备自然流畅的视觉效果和丰富的应用场景。

Fish Audio

Fish Audio是一款生成式AI文本转语音(TTS)和声音克隆平台,支持多种语言和声音风格,可将文本转换为自然流畅的语音。用户可上传音频样本克隆特定人物的声音,并通过API接口集成到应用程序中。Fish Audio适用于视频制作、有声读物、语音助手、教育与培训以及娱乐创意等领域,满足个性化语音内容生成需求。

达摩院·寻光

达摩院·寻光是一个创新的AI驱动的视频创作工具,它通过提供一系列自动化和辅助性功能,大大降低了视频创作的技术门槛,使得用户可以更加专注于创意和故事表达。

易我人声分离

易我人声分离是一款基于AI技术的音频编辑工具,可智能分离音频或视频中的人声与背景音乐,支持多种格式,并具备一键操作的便捷性。它不仅适用于音乐创作和视频剪辑,还支持精确分离乐器声音,广泛应用于语言学习、影视后期制作等多个领域。

Talk AI练口语

Talk AI是一款基于AI技术的语言学习应用,支持超过60种语言,提供实时语法纠错、智能生词本、视频通话等功能。它通过模拟真实对话场景,帮助用户提升口语能力,同时提供语言考试模拟练习。无论是在日常交流、商务场景还是旅行准备中,Talk AI都能满足不同用户的需求。

Drimo智能影视创作平台

一款由追梦极客推出的面向影视、广告从业者以及AI视频创作者设计的一站式AI影视创作平台,能为用户提供从故事想法、美术概念、人物设定、分镜生成到生成视频的一站式生成服务。

TokenFlow

一个利用预训练的文本到图像扩散模型进行视频编辑的框架。它无需进一步训练或微调,即可实现一致的视频编辑效果。

Colossyan

将专业视频编辑交给 Colossyan Creator,无需任何培训或高级技能。只需输入您的文本,即可在几分钟内准备好支持 70 多种语言的视频。