语音 - 智狐AI导航

CosyVoice 2.0

CosyVoice 2.0是一款基于深度学习的语音生成大模型，通过有限标量量化技术和新型架构设计，在发音准确性、音色一致性和韵律表达方面表现出色。其支持流式推理，延迟低至150ms，广泛应用于智能助手、有声读物、视频配音及语言学习等领域，同时具备多语言支持和情感控制等功能。

AI项目与工具 2025年06月12日 10 点赞 0 评论 629 浏览

白瓜面试

白瓜面试是一款集智能回答、代码解析、语音与图像识别于一体的AI面试辅助工具。它通过实时语音转录、图片分析及物理隔离功能，帮助求职者在技术面试和技术岗位应聘中保持高效表现。此外，它还支持在线面试、笔试优化及简历定制服务，旨在全面提升用户的面试体验。

AI项目与工具 2025年06月12日 53 点赞 0 评论 631 浏览

OpenAudio S1是Fish Audio推出的文本转语音（TTS）模型，基于200万小时音频数据训练，支持13种语言。采用双自回归架构和RLHF技术，生成自然流畅的语音，支持50多种情感和语调标记。具备零样本和少样本语音克隆功能，仅需10到30秒音频即可生成高保真声音。适用于视频配音、播客、游戏角色语音、虚拟助手、游戏娱乐、教育培训及客服系统等场景。提供40亿参数完整版和5亿参数开源版，满足

AI项目与工具 2025年06月11日 28 点赞 0 评论 631 浏览

Audio

Audio-SDS是由NVIDIA研发的音频处理技术，基于文本提示引导音频生成，支持音效生成、音源分离、FM合成及语音增强等多种任务。该技术无需重新训练模型，即可将预训练音频扩散模型扩展为多功能工具，具备高效推理能力，适用于游戏、音乐制作、教育及智能家居等多个领域。

AI项目与工具 2025年06月11日 81 点赞 0 评论 631 浏览

covers.ai

covers.ai是一款基于AI技术的音乐创作平台，提供AI语音生成与AI歌曲生成功能。用户可通过简单操作，如演唱或哼唱，由AI自动完成音乐制作，生成个性化歌曲。平台支持多种音乐风格，并允许用户自定义声音效果，适合音乐爱好者、初学者及创作者使用。其操作便捷、创意性强，有助于激发音乐灵感并提升创作效率。

AI项目与工具 2025年06月12日 31 点赞 0 评论 632 浏览