AI项目与工具

TANGOFLUX

TANGOFLUX是一款高效文本到音频生成模型,具备约5.15亿参数量,能够在3.7秒内生成30秒高质量音频。它采用CLAP-Ranked Preference Optimization框架优化音频输出,支持多种应用场景,包括多媒体内容创作、音频制作、播客、教育及虚拟助手开发。其开源特性推动了相关领域的技术进步。

DrivingDojo

DrivingDojo是一个由中国科学院自动化研究所与美团无人车团队合作研发的数据集,包含18,000个视频片段,涵盖全面的驾驶操作、多智能体交互及开放世界驾驶知识。它定义了动作指令跟随(AIF)基准,用于评估世界模型的预测能力,并支持自动驾驶算法开发、世界模型训练、多智能体交互模拟及罕见事件处理等多个应用场景。

AingDesk

AingDesk 是一款开源的 AI 模型部署工具,支持一键安装上百款 AI 模型,降低使用门槛。具备联网搜索功能,提升回答准确性;提供模型共享与多语言支持,便于团队协作与跨语言使用。内置模型管理器,优化本地资源利用,适用于学习、办公及学术研究等多种场景。

Phidias

Phidias是一款基于检索增强生成(RAG)技术的3D内容生成模型,通过元控制网络、动态参考路由和自参考增强等技术,实现高质量的3D模型生成。它可以从文本、图像或现有模型生成新内容,具备交互式生成、高保真补全等功能,广泛应用于3D艺术、游戏开发、建筑设计等领域。

AI Mirror

AI Mirror是一款基于人工智能技术的照片编辑与视频创作工具,具备丰富的滤镜选择、动漫化处理、角色生成等功能。用户可通过其多样化的编辑工具实现照片美化、风格转换及创意表达,广泛适用于社交媒体分享、节日纪念、艺术创作和个人化礼物制作等场景。

RSIDiff

RSIDiff 是一种基于递归自训练的文本到图像生成优化框架,通过高质量提示构建、偏好采样和分布加权机制,提升图像质量和与人类偏好的对齐度,减少训练崩溃风险。它具备自演化能力,降低对大规模数据的依赖,广泛应用于艺术创作、广告设计、VR/AR、游戏开发等领域。

CapWords

CapWords 是一款基于AI技术的语言学习工具,通过拍照识别物品并提供外语单词、发音及例句,支持9种语言。其核心功能包括单词贴纸、记忆卡片和智能复习提醒,帮助用户高效学习和巩固词汇。应用适用于日常学习、旅行交流、亲子互动等多种场景,适合各类语言学习者使用。

copysmith

CopySmith是一款基于人工智能技术的文案生成工具,专为电商和企业级用户提供高效的内容创作解决方案。它利用自然语言处理技术,帮助用户快速生成高质量的文章、广告文案和产品描述等文本内容。用户可通过选择模板、输入关键词等方式定制化生成所需文本,并且支持多语言版本,适合国际化业务发展。主要应用场景包括电商商品详情页优化、营销推广材料制作、企业内部沟通文档编写等,旨在提升内容创作效率与质量。

模型判官

模型判官是一款基于Next.js构建的在线AI模型评测平台,支持多模型对比、自动评估与打分、实时流式响应及国际化设计。它通过并行处理、评判模型机制和评分算法,为用户提供高效、精准的AI模型推荐服务。适用于AI模型选择、教育研究、内容创作、客户服务以及语言翻译等多个场景。

Aiuni

[Aiuni是一款利用先进AI技术将2D图像转化为高质量3D模型的在线平台。它支持纹理生成、模型优化、动画添加等功能,适用于数字媒体、游戏开发、影视制作等多个行业。其核心技术包括多视图扩散模型和网格重建算法,能快速生成高保真度的3D模型,并具备强大的细节捕捉能力。]