AnimateDiff AnimateDiff是一款由上海人工智能实验室、香港中文大学和斯坦福大学的研究人员共同开发的框架,旨在将文本到图像模型扩展为动画生成器。该框架利用大规模视频数据集中的运动先验知识,允许用户通过文本描述生成动画序列,无需进行特定的模型调优。AnimateDiff支持多种领域的个性化模型,包括动漫、2D卡通、3D动画和现实摄影等,并且易于与现有模型集成,降低使用门槛。 AI项目与工具 2024年01月01日 59 点赞 0 评论 475 浏览
Vision Parse Vision Parse 是一款开源工具,旨在通过视觉语言模型将 PDF 文件转换为 Markdown 格式。它具备智能识别和提取 PDF 内容的能力,包括文本和表格,并能保持原有格式与结构。此外,Vision Parse 支持多种视觉语言模型,确保解析的高精度与高速度。其应用场景广泛,涵盖学术研究、法律文件处理、技术支持文档以及电子书制作等领域。 AI项目与工具 2025年06月12日 72 点赞 0 评论 475 浏览
Claude Computer Use Claude Computer Use 是 Anthropic 公司推出的 AI 辅助工具,利用自然语言指令驱动 AI 模型执行计算机操作,包括屏幕阅读、文本输入、文件管理、网页浏览及软件操作等功能。该工具支持自动化脚本执行和代码编写调试,广泛适用于软件开发、数据处理、客户服务、教育等领域,具有高度智能化和灵活性的特点。 AI项目与工具 2025年06月12日 35 点赞 0 评论 474 浏览
MealSnap MealSnap是一款基于AI技术开发的饮食追踪应用程序,用户通过拍摄食物照片即可获取详细的营养信息,包括卡路里、蛋白质、脂肪和碳水化合物等。它具备强大的食物识别能力、个性化饮食建议和健康报告生成功能,帮助用户实现科学饮食管理。此外,MealSnap支持多语言操作,适用范围广泛,特别适合减肥、健身及需特殊饮食管理的人群。 AI项目与工具 2025年06月12日 71 点赞 0 评论 474 浏览
OmniParse OmniParse是一款开源数据解析平台,支持多种文件类型的非结构化数据转换为结构化格式,包括文档、图像、视频、音频及网页内容。其核心功能涵盖表格提取、图像字幕生成、音视频转录以及网页内容结构化处理,利用自然语言处理、光学字符识别及深度学习技术提升解析效率与准确性。OmniParse完全在本地运行,确保数据隐私与安全,广泛应用于文档自动化处理、客户服务、市场研究、法律合规及医疗记录管理等领域。 AI项目与工具 2025年06月12日 86 点赞 0 评论 474 浏览
彩漩 彩漩是一款基于AI技术的PPT制作平台,支持一键生成高质量演示文稿,提供智能配图、内容优化及多人协作功能。平台具备安全分享机制,支持多种格式转换和数据追踪,适用于教育、企业培训及市场营销等多种场景,兼容多端使用,提升内容创作与传播效率。 AI项目与工具 2025年06月12日 93 点赞 0 评论 474 浏览