ORM
VoiceCraft
VoiceCraft是一款开源的神经编解码器语言模型,专攻零样本语音编辑和文本到语音(TTS)任务。它采用Transformer架构,通过token重排过程结合因果掩蔽和延迟叠加技术,实现在现有音频序列内高效生成自然的语音。VoiceCraft在多种口音、风格和噪声条件下表现出色,适用于有声读物制作、视频内容创作、播客音频编辑及多语言内容生产等场景。
ColorMagic
ColorMagic是一个由人工智能驱动的色彩调色板生成工具,你可以输入图像或色彩情绪的关键字,它会根据关键词生成您输入的颜色图像的颜色。
