视频

Outspeed

Outspeed 是一个专注于实时语音和视频 AI 应用开发的平台,提供强大的流媒体处理、低延迟推理、即时部署等功能,支持企业级合规标准。其核心特性包括灵活的模型定制、全面的 SDK 支持以及高效的应用监控工具,广泛应用于客户服务、教育、医疗保健、娱乐、安全监控和质量控制等领域。

秒祝

它聚焦于视频AI生成领域。该平台拥有众多明星大咖入驻并给出预授权书,用户可以在线制作视频,无需等待录制,即刻下单即可完成。

绘蛙AI多图成片

阿里巴巴推出的一款AI图生视频工具,只需上传2-4张连贯的图片并结合文字描述,就可快速生成一段流畅自然的视频。

壁⻁看看

为货主提供快手抖音达⼈历史带货数据,快手抖音主播带货能⼒评估

跃问视频

由阶跃星辰开发的AI视频生成工具,只需通过简单的文本输入跃问视频就可以生成最长10秒的视频。

CloneAI

一款AI驱动的视频转换应用程序,可以将两张不同时空中拍摄的照片丝滑地拥抱在一起的视频,也可可以通过上传一段视频,将视频中的人物换成一个现实生活中不存在的人物,同时保证动作的完美同步。

日日新融合大模型

日日新融合大模型(SenseNova)是商汤科技推出的多模态AI系统,支持文本、图像、视频等多种数据的融合处理,具备强大的深度推理与多模态分析能力。该模型在多个权威评测中表现优异,广泛应用于自动驾驶、视频交互、办公教育、金融、园区管理及工业制造等领域,提升了多场景下的智能化水平。

MultiFoley

MultiFoley是一款基于多模态控制的音效生成系统,能够根据文本、音频或视频输入生成与视频同步的高质量Foley声音效果。它支持文本驱动和音频驱动的音效生成,同时具备音频扩展和质量控制功能,广泛应用于电影、游戏、动画及虚拟现实等领域,为用户提供灵活且高效的声音设计解决方案。

Sendspark

一种基于AI的个性化视频录制和分享,使企业能够与受众建立真正的联系。Sendspark帮助企业通过使用视频消息预订更多会议、达成更多交易并加快销售周期。

LLaVA

LLaVA-OneVision是字节跳动开发的开源多模态AI模型,主要功能包括多模态理解、任务迁移、跨场景能力、开源贡献及高性能。该模型采用多模态架构,集成了视觉和语言信息,通过Siglip视觉编码器和Qwen-2语言模型,实现高效特征映射和任务迁移学习。广泛应用于图像和视频分析、内容创作辅助、聊天机器人、教育和培训以及安全监控等领域。