Subtitle Edit
Subtitle Edit 是一款免费开源的多功能字幕编辑器,支持超过300种字幕格式。它具备字幕同步、创建、翻译、音频波形可视化、视频播放、AI语音识别、AI自动翻译和OCR技术等功能,适用于影视后期、多语言内容创作、教育培训及辅助听力障碍者等场景。其界面友好,操作简便。
Fineshare FineCut
Fineshare FineCut是一款功能全面的音频编辑工具,支持音频修剪、合并、格式转换、降噪、音量调整等功能。它适用于音乐制作、播客、视频编辑等多种场景,提供高效的音频处理解决方案。用户可通过其简洁的界面轻松完成复杂操作,满足专业与日常使用需求。
Embodied Reasoner
Embodied Reasoner是由多家科研机构联合开发的具身交互推理模型,通过视觉搜索、推理与行动协同完成复杂任务。采用模仿学习、自我探索和自我修正三阶段训练方法,生成多样化思考过程,提升任务规划效率。在长时序任务中表现优异,减少重复搜索和逻辑错误。适用于智能家居、仓储物流、医疗辅助等多个场景,具备多模态交互和强推理能力。
VideoRefer
VideoRefer是由浙江大学与阿里达摩院联合开发的视频对象感知与推理系统,基于增强型视频大型语言模型,实现对视频中对象的细粒度理解与分析。其核心包括大规模视频数据集、多功能空间-时间编码器和全面评估基准,支持对象识别、关系分析、推理预测及多模态交互等功能,适用于视频剪辑、教育、安防、机器人控制和电商等多个领域。
HivisionIDPhotos
HivisionIDPhotos 是一款基于人工智能技术的证件照制作工具,支持智能抠图、多尺寸证件照生成等功能。该工具还计划在未来版本中增加智能换正装和美颜功能。它支持 Docker 部署,并提供 API 接口以便开发者集成和自动化证件照生成流程。适用于个人、企业人力资源、教育机构、在线服务提供商及摄影工作室等多种应用场景。