Motion Dreamer Motion Dreamer是由香港科技大学(广州)研发的视频生成框架,采用两阶段架构生成物理合理的视频内容。通过引入“实例流”实现从稀疏到密集的运动控制,支持用户以少量提示生成时间连贯的视频。其随机掩码训练策略增强了模型的推理能力与泛化性能,已在多个数据集上验证其优越性。适用于视频创作、动画制作、VR/AR及自动驾驶等多个领域。 AI项目与工具 2025年06月12日 12 点赞 0 评论 661 浏览
InspireMusic InspireMusic是由阿里巴巴通义实验室开发的AI音乐生成工具,支持通过文字描述或音频提示生成多种风格的音乐作品。其核心技术包括音频 tokenizer、自回归 Transformer 模型、扩散模型(CFM)和 Vocoder,实现文本到音乐的转换、音乐续写及高质量音频输出。该工具支持长音频生成、多种采样率,并提供快速与高音质两种推理模式,适用于音乐创作、音频处理及个性化音乐生成等场景。 AI项目与工具 2025年06月12日 83 点赞 0 评论 660 浏览
START START是由阿里巴巴集团与中科大联合研发的工具增强型推理模型,通过集成外部工具(如Python代码执行器)提升大型语言模型的推理能力。其核心在于“Hint-infer”和“Hint-RFT”技术,结合长链推理与工具调用,显著提高复杂数学、科学问题及编程任务的准确性和效率。该模型具备自我调试、多策略探索和自学习能力,适用于科研、教育、编程等多个领域,是首个开源的长链推理与工具集成模型。 AI项目与工具 2025年06月12日 72 点赞 0 评论 660 浏览
MUSICHERO MUSICHERO是一款利用AI技术实现文本到音乐转换的在线生成工具,基于Suno V3.5算法,支持用户通过简单描述快速生成专业级别的音乐作品,涵盖流行、摇滚、电子等多种风格。该平台具备直观易用的特点,支持免费体验及定制化设置,适用于音乐制作、内容创作、教育培训等多个领域。 AI项目与工具 2025年06月12日 29 点赞 0 评论 660 浏览
Aishort AIShort 提供一份简便的 ChatGPT 指令列表,可迅速筛选和查询适应各种场景的提示词,从而帮助用户精简操作过程,并提供了浏览器插件方便直接调用。 Ai提示指令 2025年06月05日 89 点赞 0 评论 660 浏览
FaceCheck.ID FaceCheck.ID是一款利用人工智能和面部识别技术的平台,帮助用户在互联网和社交媒体中定位和验证个人身份。它能够搜索社交媒体、新闻、博客及犯罪数据库,提供精确的面部匹配结果,同时具有高级过滤器和隐私保护功能,适用于身份核实、诈骗防范及犯罪嫌疑人追踪等多种场景。 AI项目与工具 2025年06月12日 12 点赞 0 评论 660 浏览
ParGo ParGo是一种由字节与中山大学联合开发的多模态大语言模型连接器,通过结合局部与全局token,提升视觉与语言模态的对齐效果。其核心模块PGP和CPP分别提取图像的局部和全局信息,增强细节感知能力。在多个基准测试中表现优异,尤其在文字识别和图像描述任务中优势明显。采用自监督学习策略,提高模型泛化能力,适用于视觉问答、图像字幕生成、跨模态检索等多种场景。 AI项目与工具 2025年06月12日 38 点赞 0 评论 660 浏览
Wonderland Wonderland是一项由多伦多大学、Snap和UCLA联合开发的技术,能够基于单张图像生成高质量的3D场景,并支持精确的摄像轨迹控制。它结合了视频扩散模型和大规模3D重建模型,解决了传统3D重建技术中的视角失真问题,实现了高效的三维场景生成。Wonderland在多个基准数据集上的3D场景重建质量均优于现有方法,广泛应用于建筑设计、虚拟现实、影视特效、游戏开发等领域。 AI项目与工具 2025年06月12日 23 点赞 0 评论 660 浏览