Slides Orator Slides Orator是一款基于AI技术的演示工具,支持用户通过创建虚拟形象实现幻灯片的实时解说。其核心功能包括语音旁白生成、实时聊天互动及模拟演示场景,广泛应用于企业培训、产品推介、在线教育和会议演讲等领域,旨在提升信息传递效率和观众参与度。通过简化操作流程,该工具帮助用户高效完成高质量演示内容的准备。 AI项目与工具 2025年06月12日 69 点赞 0 评论 215 浏览
MoonCast MoonCast 是一个零样本播客生成系统,能够从纯文本源合成自然的播客风格语音。它采用长上下文语言模型和大规模语音数据训练,支持中文和英文,生成几分钟长的高质量播客音频。MoonCast 通过特定的LLM提示生成播客脚本,并利用语音合成模块转换为最终音频,具备长音频生成、增强自然性、多语言支持和零样本语音合成等功能。其技术原理包括多阶段训练、短段级别自回归音频重建和自发性增强,适用于内容创作、教 AI项目与工具 2025年06月11日 63 点赞 0 评论 215 浏览
Continue Continue是一款开源的AI代码助手,集成于VS Code和JetBrains系列IDE中,通过聊天功能和代码补全功能帮助开发者快速理解代码并完成编写。支持实时代码编辑、动作快捷方式以及自定义模型连接,旨在提高开发效率和代码质量。 AI项目与工具 2025年06月12日 71 点赞 0 评论 215 浏览
PixPin 一款功能强大、完全免费的截图、贴图工具,具备高效截图、图片标注、屏幕贴图、文字识别、屏幕录制、长截图等功能,可以满足办公等场景需求。 图片处理 2025年06月05日 40 点赞 0 评论 215 浏览
MoMask MoMask是一款基于生成式掩码建模的3D人体动作生成工具,支持文本驱动的动作创建与编辑。采用分层量化与Transformer架构,实现高精度、连贯的3D动作序列生成,在HumanML3D数据集上的FID值仅为0.045。支持动作时序控制、多平台部署及动作评估功能,适用于游戏开发、动画制作、VR及体育分析等多个领域。 AI项目与工具 2025年06月12日 19 点赞 0 评论 216 浏览
Gemini Embedding Gemini Embedding 是 Google 推出的文本嵌入模型,能将文本转化为高维向量以捕捉语义和上下文信息。支持超过 100 种语言,具备高效的检索、分类、聚类和相似性检测能力。其支持长文本输入和灵活的维度调整,适用于多场景应用,如智能搜索、数据分析和自然语言处理。模型基于 Gemini 训练,具有优秀的语言理解能力。 AI项目与工具 2025年06月12日 17 点赞 0 评论 216 浏览
Ovis2 Ovis2是阿里巴巴国际团队开发的多模态大语言模型,采用结构化嵌入对齐技术提升视觉与文本的融合效果。支持视频、图像和多语言处理,强化了思维链推理和复杂场景下的OCR能力。提供多个参数规模的版本,适用于研究、开发及各类应用场景,展现卓越性能。 AI项目与工具 2025年06月12日 67 点赞 0 评论 216 浏览
Eduwriter.ai 一种开创性论文写作工具,可以帮助学生毫不费力地撰写复杂的论文。通过选择主题、论文类型、主题领域和所需的页数,在几秒钟内轻松撰写一篇独特的论文。 AI写作对话 2025年06月05日 39 点赞 0 评论 216 浏览
Objaverse Objaverse 是一个为3D领域提供巨大资源的数据库,它不仅支持 AI 模型的训练和3D内容的生成,还与流行的3D编辑软件 Blender 兼容。 创作工具 1970年01月01日 0 点赞 0 评论 216 浏览