Whisper语音识别模型 Whisper 是一种通用的语音识别模型。它在不同音频的大型数据集上进行训练,也是一个多任务模型,可以执行多语言语音识别以及语音翻译和语言识别。 Ai开源项目 2025年06月05日 90 点赞 0 评论 348 浏览
QuickRecorder 一款基于ScreenCapture Kit for macOS的轻量级录屏工具/基于 ScreenCapture Kit的多功能、轻量化、高性能的开源macOS屏幕录制工具。 Ai开源项目 2025年06月05日 59 点赞 0 评论 298 浏览
Emote Portrait Alive 阿里巴巴发布的EMO,一种音频驱动的AI肖像视频生成框架。通过输入单一的参考图像和语音音频,Emote Portrait Alive可以生成动态的、表情丰富的肖像视频。 Ai开源项目 2025年06月05日 18 点赞 0 评论 284 浏览
BuboGPT | 字节大模型 BuboGPT是由字节跳动开发的大型语言模型,能够处理多模态输入,包括文本、图像和音频,并具有将其响应与视觉对象相对应的独特能力。 Ai平台模型 2025年06月05日 99 点赞 0 评论 122 浏览
Gemini Gemini是Google DeepMind推出的全新AI模型,集成了多模态推理功能,超越了以往模型的性能,适用于科学文献洞察、竞争性编程等多种应用场景。 Ai平台模型 2025年06月05日 100 点赞 0 评论 340 浏览
Notebook LM Google Labs开发的实验性AI工具。它利用生成式AI技术,帮助用户快速整理和总结笔记。用户可以输入各种文本或PDF文件,NotebookLM会自动组织内容并提供建议。 Ai办公效率 2025年06月05日 34 点赞 0 评论 490 浏览
PodExtra Ai 一款AI驱动播客工具,提供转录、摘要、思维导图、提纲、亮点和要点等功能,PodExtra Ai可以帮助你更高效地获取播客中的有用信息。 Ai办公效率 2025年06月05日 65 点赞 0 评论 110 浏览
智能翻译官 AI智能翻译引擎,涵盖文本、文档、图片、视频、音频等多种在线翻译模式,更有强大的文档格式转换处理功能,为您节约80%的时间。 Ai办公效率 2025年06月05日 55 点赞 0 评论 234 浏览
UniScribe 一个帮你更快的从音视频中获取信息的音视频转录和翻译工具。UniScribe能快速将本地音频、视频文件或 YouTube 视频转化为简短摘要,帮助您轻松掌握要点,支持98种语言。 Ai办公效率 2025年06月05日 33 点赞 0 评论 474 浏览