AI项目与工具

OSUM

OSUM是一款由西北工业大学研发的开源语音理解模型,结合Whisper编码器与Qwen2 LLM,支持语音识别、情感分析、说话者性别分类等多种任务。采用“ASR+X”多任务训练策略,提升模型泛化能力和稳定性。基于约5万小时语音数据训练,性能优异,适用于智能客服、教育、心理健康监测等多个领域。

JoyGen

JoyGen是由京东科技与香港大学联合开发的音频驱动型3D说话人脸视频生成框架,能够实现唇部动作与音频信号的精准同步,并提供高质量的视觉效果。该工具采用单步UNet架构进行高效视频编辑,基于130小时中文视频数据集训练,在唇音同步和视觉质量方面表现优异。适用于虚拟主播、动画制作、在线教育及多语言视频生成等多个领域,为视频内容创作提供了创新解决方案。

EMO2

EMO2是一种由阿里巴巴智能计算研究院开发的音频驱动头像视频生成技术,通过音频输入和静态人像照片生成高质量、富有表现力的动态视频。其核心技术包括音频与手部动作的协同建模、扩散模型生成视频帧,以及高精度音频同步。该工具支持多样化动作生成,适用于虚拟现实、动画制作和跨语言内容创作等场景,具备自然流畅的视觉效果和丰富的应用场景。

Genius

Genius是一款基于AI技术的照片编辑工具,支持艺术风格转换、背景扩展、图像质量提升及AI艺术生成等功能。用户可通过简单操作将普通图片转化为多种艺术形式,适用于社交媒体、摄影后期、数字艺术及商业营销等多个场景,提高创作效率与视觉表现力。

Placer.ai

Placer.ai 是一款利用人工智能和匿名数据进行位置数据分析的商业智能工具,广泛应用于零售、娱乐、消费品、房地产、金融服务等领域。其核心功能涵盖客流量测量、消费者行为分析、竞争基准对比、产业链洞察及区域分析等,帮助企业优化运营、提高绩效并制定数据驱动的战略决策。 ---

AI协同标书

AI协同标书是一款基于AI技术的标书制作工具,支持多人在线协作编辑、自动解析招标文件、一键生成标书,并具备文档比对、模拟评分等功能,帮助用户高效准确地完成标书制作,适用于政府采购、建筑工程、IT服务等多个领域。

Airparser

Airparser是一款利用GPT技术开发的数据提取工具,能够自动从电子邮件、PDF、文档等多种文件中提取结构化数据,支持60多种语言的文本识别。它具备强大的文档兼容性、自动化处理能力和与第三方应用的集成能力,广泛应用于客户关系管理、人力资源管理、财务管理等领域,帮助用户高效处理和管理数据。

COWRITER

COWRITER是一款基于人工智能的写作辅助平台,旨在通过个性化建议、实时数据集成和ChatGPT技术支持,帮助用户高效生成各类文本内容。它具备内容生成、语法校对、文本总结等功能,并适用于博客、学术研究、营销文案和创意写作等多种应用场景,显著提升写作效率和文本质量。

HARPA AI

HARPA AI是一款基于浏览器的扩展工具,集成了多个顶级GPT模型与网络自动化功能。它支持自动撰写邮件、生成SEO文章、总结网页内容、监控页面更新以及数据提取等功能,同时提供免费和付费版本,旨在通过AI技术和自动化流程提高用户的在线工作效率。

Uplimit

Uplimit 是一个AI驱动的企业学习平台,专注于提升组织内部培训和技能开发。它通过AI技术实现快速课程创建、自动化群体管理和AI模拟演练,提供个性化的学习体验,助力企业高效培养员工,提升整体竞争力。主要应用场景包括员工培训与发展、新员工入职培训、客户教育和领导力发展。