语音 - 智狐AI导航

ChatGPT Windows客户端

ChatGPT Windows客户端是一款为Windows用户打造的桌面应用程序，支持快捷键调用、截图发送、文件上传、图片拖拽、对话搜索及语音交互等功能。它旨在提升用户的工作效率，涵盖学术研究、编程开发、内容创作、客户服务和语言学习等多个领域。目前处于测试阶段，未来将全面开放。

AI项目与工具 2025年06月12日 50 点赞 0 评论 512 浏览

Spirit LM

Spirit LM 是一种由 Meta AI 开发的多模态语言模型，能够处理文本和语音数据，支持跨模态学习。其基础版（BASE）和表达版（EXPRESSIVE）分别侧重于语义理解和情感表达。Spirit LM 可用于自动语音识别（ASR）、文本到语音（TTS）、语音分类及情感分析等任务，在语音助手、语音转写、有声读物等领域具有广泛应用前景。

AI项目与工具 2025年06月12日 40 点赞 0 评论 750 浏览

NotesGPT

NotesGPT是一款开源的AI语音笔记工具，具备语音转录、自动总结及任务生成等功能，采用先进技术保障转录准确性与任务生成效率，支持多语言并适配多种使用场景，如会议记录、学术研究及个人备忘等。

AI项目与工具 2025年06月12日 80 点赞 0 评论 781 浏览

Easegen 是一款开源的 AI 工具，支持数字人课程的制作与管理。它能够批量生成 PPT 课件、克隆数字人形象和声音，并通过 AI 技术实现视频渲染和智能出题。其核心功能包括课程制作、视频管理、智能课件生成、数字人克隆及声音克隆，旨在提升教学内容的互动性和趣味性。Easegen 的技术基础涵盖人工智能、计算机视觉、自然语言处理和语音合成等，适用于在线教育、企业培训、学术研究、语言学习及职业培训

AI项目与工具 2025年06月12日 45 点赞 0 评论 509 浏览

Cleanvoice

Cleanvoice是一款利用AI技术优化音频和视频编辑的工具，适用于播客制作、视频内容编辑、企业培训、教育讲座及采访等多种场景。其核心功能包括填充词移除、背景噪音过滤、播客摘要生成、语音转录、多轨混音等，旨在提升音频质量并节省编辑时间。无论是个人创作者还是团队用户，均可通过Cleanvoice轻松实现高效的内容整理与发布。

AI项目与工具 2025年06月12日 100 点赞 0 评论 415 浏览

Moonshine

Moonshine是一款专为资源受限设备设计的高效语音识别模型，支持实时语音转文本，具有低延迟、高准确率的特点。它基于编码器-解码器架构和旋转位置嵌入技术，适应不同长度的音频输入，计算需求随音频长度变化而调整，适合边缘设备部署。主要应用于会议转录、语音助手、听力辅助及多语言翻译等领域。

AI项目与工具 2025年06月12日 76 点赞 0 评论 636 浏览

Whispo

Whispo是一款AI驱动的语音转录工具，支持用户通过快捷键快速录制语音并将其转写为文本，同时具备本地数据处理、隐私保护及基于大型语言模型的文本后处理功能。它适用于会议记录、教育、自动字幕生成等多个场景，旨在提升工作效率和用户体验。

AI项目与工具 2025年06月12日 47 点赞 0 评论 527 浏览

创音岛

创音岛是一款集录音转文字、配音、AI写歌及音频编辑于一体的综合性音乐创作与音频处理平台。它采用先进语音识别技术，支持多场景下的文字转录需求；提供多样化的配音选项和智能化音乐编曲功能，帮助用户轻松创作音乐；并配备音频编辑工具，满足用户对音频文件的精细化处理需求。该平台界面友好，操作便捷，适合音乐爱好者、创作者及专业人士使用。

AI项目与工具 2025年06月12日 42 点赞 0 评论 721 浏览

Voice Design

Voice Design是一款由ElevenLabs研发的AI语音生成工具，通过描述声音特征或虚构角色来快速生成独特的人类化语音。它支持32种语言，适用于视频旁白、广告配音、播客制作、游戏开发及虚拟助手等多个场景，为内容创作者提供高效且多样化的语音解决方案。

AI项目与工具 2025年06月12日 95 点赞 0 评论 563 浏览

Perplexity macOS客户端

Perplexity macOS 是一款基于人工智能技术的搜索工具，集成了大语言模型，支持实时联网搜索、多源内容整合及信息来源标注。其主要功能包括语音与文本输入、线索跟踪、历史记录查看及文件分析等，适用于深度研究、信息查询、知识管理和文件分析等多种应用场景，旨在提高用户的搜索效率和工作生产力。

AI项目与工具 2025年06月12日 17 点赞 0 评论 771 浏览

语音

首页

语音

列表

默认

浏览次数

发布日期