高质量

Vidsplay

Vidsplay一个高清晰免费视频资源社区,无需付费以及担心版权问题。

MultiFoley

MultiFoley是一款基于多模态控制的音效生成系统,能够根据文本、音频或视频输入生成与视频同步的高质量Foley声音效果。它支持文本驱动和音频驱动的音效生成,同时具备音频扩展和质量控制功能,广泛应用于电影、游戏、动画及虚拟现实等领域,为用户提供灵活且高效的声音设计解决方案。

Lumina

Lumina-Image 2.0 是一款开源图像生成模型,基于扩散模型与 Transformer 架构,具有 26 亿参数。它能根据文本描述生成高质量、多风格的图像,支持中英文提示词,并具备强大的复杂提示理解能力。模型支持多种推理求解器,适用于艺术创作、摄影风格图像生成及逻辑推理场景,兼具高效性和灵活性。

CCI 3.0

CCI 3.0是一项由智源研究院开发的大规模中文互联网语料库,包含1000GB主数据集及498GB高质量子集。该语料库覆盖新闻、社交媒体、博客等领域,数据规模较前代扩大近一倍,来源增至20余家机构。通过多维度标注与数据清洗技术,CCI 3.0筛选出高价值数据,适用于自然语言处理、大模型训练、知识图谱构建、内容推荐系统以及教育科研等多种应用场景。

SoundRaw AI

面向创作者的 AI 音乐生成器,只需选择情绪、流派和长度,SoundRaw AI就能为你生成优美的歌曲。

MeloTTS

MeloTTS是一个高质量的多语言文本转语音(TTS)库,由MyShell AI开发。该工具支持多种语言的文本转语音任务,包括英语(含不同口音)、西班牙语、法语、中文、日语和韩语,并具备快速的语音合成速度。MeloTTS不仅支持中英混合发音,还易于安装和使用,适用于多种操作系统和环境。用户可以在GitHub和Hugging Face平台上获取和体验MeloTTS。

Veo 3

Veo 3是谷歌推出的新一代视频生成模型,在I/O开发者大会上发布。它是首个能生成视频背景音效的模型,可合成画面并匹配人物对话和口型,支持1080P高质量视频生成,具备物理模拟与口型同步能力,可生成超过60秒的视频片段,并支持多种视觉风格。Veo 3整合了多项先进技术,适用于影视制作、广告营销及教育领域。

Waymark

Waymark是一个视频制作工具,可以帮助企业快速轻松地制作高影响力的广告。它允许用户导入商业信息,然后由人工智能根据他们的品牌生成视频。该视频可以进行最后的调整,并在电视、...

Heymodel AI

Heymodel AI是基于人工智能技术的AI模特商业摄影服务,为品牌寻找最佳的 AI 模特解决方案。它可以提供多种模特形象,包括不同的年龄、肤色、性别、发型等,以满足不同客户的需求。

AI Signature Generator

AI Signature Generator 是一款利用AI技术的开源在线工具,可以根据用户输入的名字或首字母生成个性化的电子签名。生成的签名不仅具有手写效果,还融入了书法艺术元素,使其更显美观和专业。该工具提供了多种风格和设计选项,用户可以根据个人品味或专业需求进行选择和调整。生成的签名可用于电子邮件、数字文档签名等多种场合,提供了一种快速、便捷且免费的方式来增强个人或品牌形象。