Visio Studio 一款先进的图像捕获、背景移除和编辑工具。它为用户提供了一个全面的解决方案,用于创建高质量的视觉效果并增强其图像。 Ai图片处理 2025年06月05日 75 点赞 0 评论 705 浏览
Psi R0 Psi R0是一款基于强化学习的端到端具身模型,支持双灵巧手协同操作,具备多技能串联混训和跨物品、跨场景的泛化能力。通过仿真数据训练及技能优化,Psi R0能在复杂环境中完成长程任务,同时具备自主切换技能的功能,确保高成功率和鲁棒性。主要应用场景包括电商商品打包、工厂产线组装、服务业拣货打包及家居环境清洁整理。 AI项目与工具 2025年06月12日 18 点赞 0 评论 705 浏览
InvSR InvSR是一款基于扩散模型逆过程开发的图像超分辨率工具,通过深度噪声预测器和灵活采样机制,从低分辨率图像恢复高质量高分辨率图像。它支持多种应用场景,包括文化遗产保护、视频监控、医疗成像及卫星影像分析,同时兼顾计算效率与性能表现。 AI项目与工具 2025年06月12日 14 点赞 0 评论 706 浏览
Voicemaker Voicemaker,强大的文本到语音转换器,它也能通过先进的人工智能技术来制作高质量的画外音,听起来像人性化且富有表现力。 Ai语音工具 2025年06月05日 44 点赞 0 评论 706 浏览
TIGER TIGER是由清华大学研发的轻量级语音分离模型,采用时频交叉建模策略与多尺度注意力机制,有效提升语音分离性能,同时显著降低计算和参数开销。模型通过频带切分优化资源利用,适应复杂声学环境,广泛应用于会议记录、视频剪辑、电影音频处理及智能语音助手等领域。 AI项目与工具 2025年06月12日 98 点赞 0 评论 706 浏览
Concept Lancet Concept Lancet(CoLan)是一种基于潜在空间稀疏分解的图像编辑框架,能够实现零样本、即插即用的精确概念替换、添加与移除。它通过构建视觉概念字典,结合扩散模型生成高质量图像,保持视觉一致性。适用于创意设计、影视制作、游戏开发等多个领域,提供高效的图像编辑解决方案。 AI项目与工具 2025年06月11日 28 点赞 0 评论 707 浏览
MatAnyone MatAnyone是一款由南洋理工大学S-Lab实验室与商汤科技联合开发的视频抠图框架,专注于复杂背景下人像视频的精准分割。采用一致内存传播和区域自适应内存融合技术,确保视频中目标的语义稳定性和边界细节精度。结合大规模分割数据和优化的训练策略,提升了模型在真实场景下的性能。适用于影视制作、直播、广告、游戏开发等多个领域,具备高精度、强适应性和良好的交互性。 AI项目与工具 2025年06月12日 48 点赞 0 评论 708 浏览
宾夕法尼亚大学 宾夕法尼亚大学(University of Pennsylvania),简称宾大(UPenn),位于宾夕法尼亚州费城,私立研究型大学,常春藤盟校之一,美国大学协会创始成员。全球大学校长论坛成员。 宾... 教育学习 1970年01月01日 0 点赞 0 评论 709 浏览