Heymodel AI Heymodel AI是基于人工智能技术的AI模特商业摄影服务,为品牌寻找最佳的 AI 模特解决方案。它可以提供多种模特形象,包括不同的年龄、肤色、性别、发型等,以满足不同客户的需求。 电商运营 2025年06月05日 60 点赞 0 评论 899 浏览
Veo 3 Veo 3是谷歌推出的新一代视频生成模型,在I/O开发者大会上发布。它是首个能生成视频背景音效的模型,可合成画面并匹配人物对话和口型,支持1080P高质量视频生成,具备物理模拟与口型同步能力,可生成超过60秒的视频片段,并支持多种视觉风格。Veo 3整合了多项先进技术,适用于影视制作、广告营销及教育领域。 AI项目与工具 2025年06月11日 90 点赞 0 评论 898 浏览
Waymark Waymark是一个视频制作工具,可以帮助企业快速轻松地制作高影响力的广告。它允许用户导入商业信息,然后由人工智能根据他们的品牌生成视频。该视频可以进行最后的调整,并在电视、... Ai视频生成 2026年07月27日 0 点赞 0 评论 898 浏览
MeloTTS MeloTTS是一个高质量的多语言文本转语音(TTS)库,由MyShell AI开发。该工具支持多种语言的文本转语音任务,包括英语(含不同口音)、西班牙语、法语、中文、日语和韩语,并具备快速的语音合成速度。MeloTTS不仅支持中英混合发音,还易于安装和使用,适用于多种操作系统和环境。用户可以在GitHub和Hugging Face平台上获取和体验MeloTTS。 AI项目与工具 2024年01月01日 57 点赞 0 评论 896 浏览
CCI 3.0 CCI 3.0是一项由智源研究院开发的大规模中文互联网语料库,包含1000GB主数据集及498GB高质量子集。该语料库覆盖新闻、社交媒体、博客等领域,数据规模较前代扩大近一倍,来源增至20余家机构。通过多维度标注与数据清洗技术,CCI 3.0筛选出高价值数据,适用于自然语言处理、大模型训练、知识图谱构建、内容推荐系统以及教育科研等多种应用场景。 AI项目与工具 2025年06月12日 16 点赞 0 评论 890 浏览
Lumina Lumina-Image 2.0 是一款开源图像生成模型,基于扩散模型与 Transformer 架构,具有 26 亿参数。它能根据文本描述生成高质量、多风格的图像,支持中英文提示词,并具备强大的复杂提示理解能力。模型支持多种推理求解器,适用于艺术创作、摄影风格图像生成及逻辑推理场景,兼具高效性和灵活性。 AI项目与工具 2025年06月12日 27 点赞 0 评论 887 浏览
MultiFoley MultiFoley是一款基于多模态控制的音效生成系统,能够根据文本、音频或视频输入生成与视频同步的高质量Foley声音效果。它支持文本驱动和音频驱动的音效生成,同时具备音频扩展和质量控制功能,广泛应用于电影、游戏、动画及虚拟现实等领域,为用户提供灵活且高效的声音设计解决方案。 AI项目与工具 2025年06月12日 78 点赞 0 评论 886 浏览
YourOwnStoryBook YourOwnStoryBook是一款用自己作为主角、情节和插图使用人工智能 (AI) 创作自己个性化的故事和插图的应用程序。这是一种与孩子一起阅读和创作的有趣而简单的方法。 教育学习 2025年06月05日 16 点赞 0 评论 876 浏览