视频

AnyCharV

AnyCharV是一款由多所高校联合研发的角色可控视频生成框架,能够将任意角色图像与目标场景结合,生成高质量视频。它采用两阶段训练策略,确保角色细节的高保真保留,并支持复杂的人-物交互和背景融合。该工具兼容多种文本生成模型,具备良好的泛化能力,适用于影视制作、艺术创作、虚拟现实等多个领域。

声网Agora

专注于实时音视频技术的云服务公司,全球实时互动云服务开创者和引领者。开发者只需简单调用声网API,即可在应用内构建多种实时音视频互动场景。

Running Hub

作为一个在线AIGC工作流创作平台,为用户提供了一个便捷、高效、实时更新的创作环境。它不仅降低了技术门槛,还通过丰富的资源和工具,激发了创作者的创意,帮助他们实现创意变现。

NarratoAI

NarratoAI是一款基于AI技术的影视解说和编辑工具,它利用大型语言模型(LLM)、计算机视觉和自然语言处理技术来理解视频内容,自动生成解说文案,并将文案转化为配音,同时进行视频剪辑和字幕生成。该工具支持个性化定制,可以满足不同用户的视频制作需求,简化视频制作流程,帮助非专业人士快速制作出专业水准的视频内容。

万相营造

阿里妈妈旗下的一款AI电商营销工具,原名万相实验室。万相营造基于生成式AI智能技术,能够快速生成商品图、视频和文案。

Link2

一款专为内容创作者打造的工具,提供一键提取/批量提取短视频文案,无水印下载短视频服务

Motionit AI

​MotionIt.ai是一款利用人工智能生成令人惊叹的幻灯片和视频的先进平台,用于各种用途

Faster Whisper

Faster Whisper 是一款基于 OpenAI Whisper 模型的高效语音识别工具,利用 CTranslate2 引擎显著提升转写速度并降低内存消耗。它支持多语言处理,可应用于实时语音转写、视频字幕生成、客户服务、医疗记录等领域。其核心技术包括 8 位量化、语音活动检测(VAD)及模型优化,同时提供灵活的 API 接口供开发者集成。