Loong Loong是一种基于自回归大型语言模型的长视频生成工具,能够生成长达一分钟以上的高质量视频。其核心技术包括统一序列建模、渐进式训练方法及损失重新加权策略,确保生成视频在内容连贯性、动态丰富性和场景过渡上的卓越表现。Loong广泛适用于娱乐、教育、广告等多个领域,助力用户快速生成个性化、专业化的视频内容。 AI项目与工具 2025年06月12日 60 点赞 0 评论 304 浏览
StableV2V StableV2V是一款基于文本、草图和图片输入的开源视频编辑工具,利用Prompted First-frame Editor(PFE)、Iterative Shape Aligner(ISA)和Conditional Image-to-video Generator(CIG)三大模块,实现视频中物体的精准编辑与替换,同时保持编辑内容与原始视频在动作和深度信息上的高度一致性,适用于电影制作、教育、 AI项目与工具 2025年06月12日 21 点赞 0 评论 305 浏览
HermitAI 一款专为外贸/跨境人员打造的营销文案撰写工具,可以智能生成多场景跨境外贸营销文案,解决邮件、社媒平台、跨境平台、翻译等多种工作场景。 AI写作对话 2025年06月05日 88 点赞 0 评论 305 浏览
PiliPala 一款基于Flutter开发的B站开源第三方客户端。支持Android和iOS平台,提供无广告的高清视频播放体验,具备倍速播放、离线缓存、稍后再看等功能。 Ai开源项目 2025年06月05日 22 点赞 0 评论 306 浏览
Wav2Lip Wav2Lip是一款开源的唇形同步工具,能够将音频文件转换为与口型同步的视频。它支持多种语言,适用于视频编辑、游戏开发和虚拟现实等多个领域。Wav2Lip具备音频驱动口型生成、面部表情同步和多语言支持等功能,采用先进的技术原理,如数据预处理、音频特征提取、口型编码器、音频到口型映射及生成对抗网络(GAN)。该工具提升了电影和视频的后期制作质量,增强了虚拟现实中的交互体验,还用于游戏开发、语言学习和 AI项目与工具 2025年06月12日 80 点赞 0 评论 306 浏览
商汤如影 商汤如影是一款由商汤科技开发的AI数字人视频生成平台,通过先进大模型技术创建高度逼真的数字人形象,应用于教育、金融、营销等领域。平台具备数字人创建、声音克隆、视频生成、自动化数据标注、图片生成、实时互动等功能,并支持多语言及多种服务形式,以满足个性化和专业化的服务需求。 AI项目与工具 2025年06月12日 93 点赞 0 评论 306 浏览
Cutout Pro Cutout Pro成立于2018年,拥有一群技术狂,cutout.pro 利用人工智能和计算机视觉的力量提供范围广泛的产品,让您的生活更加丰富多彩 更轻松,您的工作更高效。 Ai图片处理 2025年06月05日 49 点赞 0 评论 306 浏览
InternVL3 InternVL3是上海人工智能实验室推出的多模态大型语言模型,具备文本、图像、视频等多模态数据处理能力。采用原生多模态预训练方法,提升语言与视觉理解效率,并支持工具使用、3D视觉、工业图像分析等复杂任务。模型可通过API部署,适用于智能交互、图像识别、视频分析及客服系统等多种场景。 AI项目与工具 2025年06月11日 68 点赞 0 评论 306 浏览