AudioBox Audiobox 是 Meta 推出的 AI 语音和音效工具,结合语音输入和自然语言文字提示词生成语音和音效,例如输入提示词「一条流淌的河流和鸟儿在鸣叫」,Audiobox 自动生成音效。 Ai语音工具 2025年06月05日 77 点赞 0 评论 248 浏览
URO URO-Bench 是一个面向端到端语音对话模型的综合评估工具,支持多语言、多轮对话及副语言信息处理。它包含基础和高级两个赛道,分别涵盖16个和20个数据集,覆盖开放性问答、情感生成、多语言任务等。支持多种评估指标,提供简单易用的评估流程,并兼容多种语音对话模型。适用于智能家居、个人助理、语言学习等多个实际应用场景。 AI项目与工具 2025年06月12日 47 点赞 0 评论 249 浏览
Zoe Zoe是一款专注于外贸行业的AI代理工具,支持从市场分析到客户转化的全流程自动化操作。它利用先进算法处理大数据,精准识别潜在客户并建立私有买家池,实现7×24小时多语言、多渠道触达。通过智能生成营销内容和动态优化沟通策略,大幅提升客户开发效率与转化率。 AI项目与工具 2025年06月11日 39 点赞 0 评论 250 浏览
青梧字幕 青梧字幕是一款基于AI语音识别技术的字幕提取工具,能够从视频中精准提取语音内容并生成时间轴字幕。支持多语言识别、多格式导出及多语种翻译,适用于视频创作者、外语学习者及字幕团队。所有数据处理在本地完成,保障隐私安全,兼容Windows和MacOS系统,提升字幕制作效率。 AI项目与工具 2025年06月12日 90 点赞 0 评论 250 浏览
VideoSrt VideoSrt是一个可以识别视频语音自动生成字幕SRT文件的开源软件工具。适用于快速、批量的为媒体(视频/音频)生成中/英文字幕、文本文件的业务场景。 Ai开源项目 2025年06月05日 31 点赞 0 评论 253 浏览
LDGen LDGen是一款结合大型语言模型与扩散模型的文本到图像生成工具,支持零样本多语言生成,提升图像质量和语义一致性。通过分层字幕优化、LLM对齐模块和跨模态精炼器,实现文本与图像的高效交互。实验表明其性能优于现有方法,适用于艺术创作、广告设计、影视制作等多个领域,具备高效、灵活和高质量的生成能力。 AI项目与工具 2025年06月12日 59 点赞 0 评论 253 浏览
Hedy AI Hedy AI 是一款提升会议与对话效率的AI工具,支持19种语言,提供实时转录、智能总结、个性化提示及上下文敏感的见解。适用于商务会议、面试、课堂及医疗预约等场景,帮助用户更好地理解信息、提出有效问题并提升参与度。支持跨设备使用,注重隐私保护,适合多语言环境下的高效沟通。 AI项目与工具 2025年06月11日 72 点赞 0 评论 253 浏览
Resume Matcher Resume Matcher 是一个免费的开源项目,专门为开发者设计,以简化简历创建过程并加速求职搜索。 创作工具 1970年01月01日 0 点赞 0 评论 253 浏览