Tesseract Tesseract是一款开源的光学字符识别(OCR)引擎,支持多语言识别和多种图像格式。其具备高精度的文字识别能力,适用于文档数字化、表格数据提取、发票识别及移动OCR应用等多个场景。支持跨平台运行,并提供丰富的编程接口和自定义训练功能,便于开发者集成和优化识别效果。 AI项目与工具 2025年06月12日 12 点赞 0 评论 698 浏览
擎舵 擎舵是百度营销推出的多模态AIGC创意生产平台,专注于视频、图片、文字等内容的智能生成。平台通过百度大模型技术支持,实现一键生成视频、图片、文字,自动识别视频素材内容,生成营销图,制作数字人视频,支持图片数字人生成及数字人形象与语音定制。擎舵服务于教育、汽车、旅游等多个行业,提供全流程AI赋能,帮助用户提升营销效率。 AI项目与工具 2025年06月12日 17 点赞 0 评论 695 浏览
SadTalker SadTalker是一个由西安交通大学、腾讯AI实验室和蚂蚁集团合作开发的开源AI数字人项目。该工具利用单张人脸图像和语音音频,通过3D运动系数生成逼真的说话人脸动画。它通过ExpNet精确学习面部表情,PoseVAE合成不同风格的头部运动,并采用3D面部渲染技术,实现高质量、风格化的视频动画。SadTalker还具备多语言支持和多模态学习能力,适用于虚拟助手、视频制作、语言学习、社交媒体和教育等 AI项目与工具 2025年06月12日 71 点赞 0 评论 693 浏览
CLAID.AI CLAID.AI是一款基于AI的图像生成与优化平台,适用于电子商务及数字营销领域。它利用生成式AI技术快速生成逼真的产品照片,并提供背景移除、图像增强、尺寸调整、批量处理和自定义输出等功能,帮助用户提升产品图像的质量与专业度。此外,CLAID.AI支持API集成,便于与其他系统无缝对接。 AI项目与工具 2025年06月12日 49 点赞 0 评论 693 浏览
AI京医 AI京医是京东健康推出的医疗大模型产品体系,涵盖AI诊疗助手、数字医生智能体和AI科研助手,覆盖诊前、诊中、诊后全流程,提升医生工作效率与科研能力,同时优化患者就医体验,实现智能化、个性化的医疗服务。 AI项目与工具 2025年06月12日 54 点赞 0 评论 691 浏览
MIDI MIDI是一种基于多实例扩散模型的3D场景生成技术,能将单张2D图像快速转化为高保真度的360度3D场景。它通过智能分割、多实例同步扩散和注意力机制,实现高效的3D建模与细节优化。具有良好的泛化能力,适用于游戏开发、虚拟现实、室内设计及文物数字化等多个领域。 AI项目与工具 2025年06月12日 64 点赞 0 评论 690 浏览
澜舟科技 澜舟科技是业界领先的认知智能公司,致力于以自然语言处理(NLP)技术为基础,为全球企业提供新一代认知智能平台,助力企业数字化转型升级。 Ai科技公司 2025年06月05日 74 点赞 0 评论 690 浏览