GTSinger GTSinger是一项由浙江大学研发的开源高质量歌声数据集,包含80.59小时的多语言专业录音棚歌声数据,支持歌声合成、技巧识别、风格迁移和语音到歌声转换等多种任务。它通过音素级标注和真实乐谱支持,为歌唱技巧的研究和应用提供了强大工具。 AI项目与工具 2025年06月12日 77 点赞 0 评论 608 浏览
Largo Largo是一个基于AI技术的影视内容开发平台,通过分析海量影视数据为制片人、发行方和工作室提供数据驱动的洞察和决策支持。其核心功能包括剧本分析、角色与选角建议、财务预测、品牌测试以及项目与融资匹配,帮助优化制作流程、降低风险并提升内容吸引力。 AI项目与工具 2025年06月11日 79 点赞 0 评论 608 浏览
15个AI生成PPT的工具和网站,智能制作精美的幻灯片 本文介绍了15款AI驱动的PPT生成工具,这些工具通过人工智能技术简化了PPT的创建过程,提升了演示文稿的专业度和吸引力。它们支持一键生成高质量PPT、智能内容生成、模板自定义、文本驱动创作、多格式导出等功能,适用于多种场合,包括商务、教育、科研等领域,极大地提高了工作效率和演示效果。 AI项目与工具 2023年05月12日 77 点赞 0 评论 607 浏览
子曰翻译2.0 子曰翻译2.0是网易有道推出的最新翻译大模型,通过数据优化、算法升级和严格评估体系,实现翻译质量与效率的显著提升。支持中英互译、专业领域翻译及多场景应用,涵盖学术、医疗、文学等领域,具备高准确性、流畅性和适应性,适用于多种翻译需求。 AI项目与工具 2025年06月12日 93 点赞 0 评论 607 浏览
Sekai Sekai是一款结合AI技术的交互式内容平台,允许用户创建和自定义虚拟角色,并通过AI生成完整的故事情节。平台支持互动式叙事、沉浸式体验以及故事编辑与分享功能,适用于个人娱乐、社交互动、教育学习及品牌营销等多种场景。 AI项目与工具 2025年06月12日 55 点赞 0 评论 607 浏览
Embed3 Embed3是一款由Cohere研发的多模态AI搜索模型,支持从文本和图像生成嵌入向量,实现智能化的跨模态搜索。它能够处理多种语言,支持复杂数据集的快速检索,并提供一致的用户体验。主要功能包括多模态搜索能力、跨语言支持、增强型检索-生成系统以及简化数据管理。适用于商业智能、电子商务、设计创作、文档管理和客户服务等多个领域。 AI项目与工具 2025年06月12日 16 点赞 0 评论 607 浏览
IMGGEN.AI IMGGEN.AI是一款利用先进AI技术的在线图片生成工具,用户可通过文本输入生成高分辨率图片,并享受图像锐化、老照片修复、颜色校正和去模糊等多种功能。该工具操作简便,适用于个人、商业及艺术创作等多个场景,支持免费下载使用。 AI项目与工具 2025年06月12日 80 点赞 0 评论 606 浏览
MT MT-MegatronLM 是摩尔线程推出的开源混合并行训练框架,支持密集模型、多模态模型和 MoE 模型的高效训练。采用 FP8 混合精度、高性能算子库和集合通信库,提升 GPU 集群算力利用率。通过模型并行、数据并行和流水线并行技术,实现大规模语言模型的高效分布式训练,适用于科研、企业及定制化 AI 应用场景。 AI项目与工具 2025年06月12日 25 点赞 0 评论 606 浏览
MARS MARS是一款由字节跳动开发的优化框架,专注于提升大型模型训练效率。它融合了预条件梯度方法与方差减少技术,并通过缩放随机递归动量技术优化梯度估计。MARS支持多种Hessian近似方式,可生成基于AdamW、Lion和Shampoo的优化算法实例。该框架适用于深度神经网络、大规模语言模型、计算机视觉任务及强化学习等领域,能有效加速模型收敛并提高训练稳定性。 AI项目与工具 2025年06月12日 79 点赞 0 评论 606 浏览
Llasa TTS Llasa TTS是基于LLaMA架构的开源文本转语音模型,支持高质量语音合成、情感表达和音色克隆。采用单层VQ编解码器和Transformer结构,具备多语言支持及长文本处理能力,适用于智能助手、有声读物、游戏娱乐等场景。模型提供不同参数规模版本,支持零样本学习,提升语音自然度和表现力。 AI项目与工具 2025年06月12日 71 点赞 0 评论 606 浏览