无障碍技术

Vocloner

Vocloner是一款基于人工智能的在线语音克隆工具，用户可通过上传目标语音音频并输入文本，快速生成克隆声音，无需训练语音网络。支持多语言及多种中文方言，提供经典版本和更新版本两种克隆选项，经典版使用Coqui TTS技术，更新版采用Coqui AI的XTTS工具，增强克隆效果。功能包括即时语音克隆、模型创建与保存、多语言支持、不同说话风格和角色模仿，适用于内容创作、无障碍支持、语言学习和个性化数

AI项目与工具 2025年06月11日 47 点赞 0 评论 616 浏览

MoshiVis

MoshiVis是一款由Kyutai开发的开源多模态语音模型，支持图像与语音的自然交互。它基于Moshi 7B架构，集成了视觉编码器和跨注意力机制，实现低延迟、自然流畅的对话体验。支持多种后端部署，适用于无障碍应用、智能家居、教育及工业场景，提升人机交互的智能化水平。

AI项目与工具 2025年06月12日 72 点赞 0 评论 675 浏览

IndexTTS

IndexTTS 是一款由 B 站开发的高性能文本转语音系统，专注于中文语音合成，支持拼音纠正、精准停顿控制和高自然度语音输出。采用混合建模方法，结合汉字与拼音，提升发音准确性。系统具备零样本语音克隆能力，音质优秀，广泛应用于内容创作、在线教育、智能客服等领域。训练数据丰富，性能指标优异，包括低字词错误率、高扬声器相似性和高主观音质评分。

AI项目与工具 2025年06月12日 15 点赞 0 评论 425 浏览

Signs

Signs是由英伟达推出的AI手语学习平台，通过实时手势识别与3D虚拟教学，帮助用户精准掌握美式手语。平台支持用户上传视频，丰富学习资源，具备互动性与个性化反馈，适用于初学者及进阶学习者，同时为无障碍技术开发提供数据支持。

AI项目与工具 2025年06月12日 69 点赞 0 评论 757 浏览

Whispo

Whispo是一款AI驱动的语音转录工具，支持用户通过快捷键快速录制语音并将其转写为文本，同时具备本地数据处理、隐私保护及基于大型语言模型的文本后处理功能。它适用于会议记录、教育、自动字幕生成等多个场景，旨在提升工作效率和用户体验。

AI项目与工具 2025年06月12日 47 点赞 0 评论 526 浏览

无障碍技术

首页

无障碍技术

列表

默认

浏览次数

发布日期

Vocloner

MoshiVis

IndexTTS

Signs

Whispo

无障碍技术 首页 无障碍技术

列表 默认 浏览次数 发布日期

Vocloner

MoshiVis

IndexTTS

Signs

Whispo

无障碍技术

首页

无障碍技术

列表

默认

浏览次数

发布日期