MacWhisper MacWhisper是一款基于OpenAI Whisper技术的AI音频转文字工具。它能够在本地设备上将音频文件快速转录成文本,并支持多种语言。该工具具有多种音频和视频格式兼容性,提供不同的转录模型选择,支持字幕导出,且具备视频播放功能。最新版本增加了基于Apple芯片的硬件加速,提升了实时语音识别效率,并集成了OpenAI语言模型以提高转录和翻译的准确性。MacWhisper适用于记者、媒体工作 AI项目与工具 2025年06月12日 15 点赞 0 评论 613 浏览
VideoChat VideoChat是一款开源的实时数字人对话系统,支持语音输入与实时对话功能。用户可自定义数字人形象与音色,实现音色克隆。系统集成多种技术,包括语音识别、大语言模型生成及文本转语音,支持流式视频输出,适用于客户服务、在线教育、新闻播报、直播互动及娱乐等多个领域。 AI项目与工具 2025年06月12日 35 点赞 0 评论 613 浏览
StarRocks MCP Server StarRocks MCP Server 是一款用于 AI 助手与 StarRocks 数据库之间数据交互的工具,支持直接执行 SQL 查询、获取数据库结构、访问系统指标,并能生成数据可视化图表。其具备智能缓存、灵活配置等功能,适用于多维分析、AI 与数据库集成、数据探索等场景,提升数据处理与分析效率。 AI项目与工具 2025年06月11日 85 点赞 0 评论 614 浏览
幕布 幕布是一款AI驱动的大纲笔记工具,支持结构化知识整理与一键生成思维导图,帮助用户更高效地理解和记忆信息。其功能涵盖任务拆解、团队协作、多平台同步及Markdown编辑等,适用于学习、工作与会议管理等多种场景,提升信息处理效率与组织能力。 AI项目与工具 2025年06月11日 34 点赞 0 评论 615 浏览
VenturusAI VenturusAI 基于GPT为您的商业理念提供建议的工具。无论您是想开始创业、推出新产品还是改进现有产品,VenturusAI 都可以帮助您进行全面的业务分析、目标受众识别、定制业务策略、营销和品牌指导以及创新理念和机会。 创业营销 2025年06月05日 41 点赞 0 评论 615 浏览
AgentCPM AgentCPM-GUI是由清华大学与面壁智能团队联合开发的开源端侧GUI代理系统,专为中文应用场景优化。基于MiniCPM-V模型,支持通过截图输入并自主执行用户指令,具备高精度GUI元素识别与OCR能力。采用强化微调和紧凑动作空间设计,提升任务执行效率与移动端适配性。适用于智能助手、自动化测试、老年人辅助及企业应用等领域。 AI项目与工具 2025年06月11日 18 点赞 0 评论 615 浏览
Aconvert 一款免费的在线格式转换工具,支持多达 110 多种文件格式转换,包括 PDF、文档、电子书、图片、音频、视频和压缩文件等。 格式转换 2025年06月05日 28 点赞 0 评论 616 浏览
YAYI2 中科闻歌研发的一款新一代开源大语言模型,中文名为“雅意”。该模型包含 Base 和 Chat 版本,参数规模达到 30B,基于 Transformer 架构构建。 Ai平台模型 2025年06月05日 11 点赞 0 评论 616 浏览
MarkItDown MarkItDown是一款由微软推出的开源文档转换工具,支持多种文件格式(如PDF、Office文档、图像、音频等)转换为Markdown格式。它具备OCR文字识别、语音转文字、元数据提取等功能,适用于文档归档、内容发布、数据挖掘、学术研究等多个场景,旨在简化文件处理流程,提升工作效率。通过提供简单易用的API接口,MarkItDown成为开发者友好型工具。 AI项目与工具 2025年06月12日 22 点赞 0 评论 617 浏览