多语言

MaskGCT

MaskGCT是一款基于掩码生成模型与语音表征解耦编码技术的语音合成大模型,由趣丸科技与香港中文大学(深圳)联合开发。其主要功能包括声音克隆、跨语种语音合成、语音控制及高质量语音数据集支持。该模型在多个TTS基准数据集上表现优异,可快速精准地克隆音色并灵活调整语音属性,适用于多种语言,已开源并面向全球用户开放。

Pidgeon

Pidgeon是一款利用人工智能技术的新闻聚合应用,主要功能包括生成简洁的新闻摘要、整合全球新闻资源、支持多语言及个性化定制。用户可通过智能分类筛选新闻内容,并享受无广告干扰的阅读体验。此外,Pidgeon还提供离线阅读和多模式切换功能,适用于快速获取全球资讯的用户。

FineWeb 2

FineWeb 2是一个涵盖超过1000种语言的多语言预训练数据集,通过语言识别、去重、内容过滤及PII匿名化处理生成。它支持多种NLP任务,如机器翻译和文本分类,旨在增强多语言模型的性能与普适性,并为研究者提供技术验证的工具与资源。

Universal

Universal-1是一款由AssemblyAI开发的多语言语音识别和转录模型,经过大量多语种音频数据训练,支持英语、西班牙语、法语和德语等。该模型在各种复杂环境中提供高精度的语音转文字服务,具备快速响应能力和改进的时间戳准确性。Universal-1在准确率、响应时间、时间戳估计和用户偏好等方面表现优异,适用于对话智能平台、AI记事本、创作者工具和远程医疗平台等多个应用场景。

极速箱

一个高颜值的在线开发工具集成平台,专为程序员设计,提供多种实用工具,如JSON处理、编码解码、网络测试等,帮助开发者提升编程效率。

nijijourney

Nijijourney是一款由Spellbrush和Midjourney合作开发的AI工具,主要功能包括基于文本指令生成二次元风格图像、支持图像风格转换、细节微调以及多语言兼容性。它广泛应用于艺术创作、游戏开发、动画制作、漫画绘制及小说插图等领域,帮助用户高效完成高质量的二次元风格视觉内容。

Whisper Input

Whisper Input 是一款开源语音输入工具,基于 Python 和 OpenAI Whisper 模型开发,支持多语言语音识别与实时转录。用户可通过快捷键操作录音并生成文本,具备翻译、自动标点、高效处理及本地运行等功能。适用于会议记录、教育、智能交互及媒体制作等多种场景。

Klap

Klap是一款利用AI技术的视频编辑工具,主要功能包括将长视频快速转换为适合社交媒体平台的短视频、智能场景分析、自动裁剪与布局优化、多语言字幕生成等。它支持一键分享至各大社交平台,帮助用户提高内容传播效率。适用于个人、品牌及教育机构等多种场景。

华为小艺

华为小艺是华为推出的一款AI助手,支持网页端访问,具备AI问答、写作、编程辅助、翻译及联网搜索等功能。其接入DeepSeek-R1智能体,支持实时信息检索,提升交互精准度。用户可通过语音或文本与小艺互动,适用于知识查询、多语言沟通、内容创作等场景,支持深度思考模式,满足多样化的使用需求。

小麦AI图片翻译

一款基于本地AI模型的图片翻译工具,具有快速、精准和永久免费等特点。小麦AI图片翻译支持多种语言的翻译,并允许用户对翻译结果进行二次编辑,适合需要频繁处理图片翻译的用户。