AI项目与工具

ZenCtrl

ZenCtrl 是一款基于 AI 技术的图像生成工具,可从单张图像生成多视角、多样化场景,支持实时元素再生。具备高精度控制功能,适用于产品摄影、虚拟试穿、人物肖像控制、插画等场景。提供预处理与后处理能力,提升图像质量,架构模块化,适应多种创意需求。

MNN

MNN是一个由阿里巴巴开源的轻量级深度学习推理框架,支持多种模型格式和网络结构,具备高性能、低内存占用及跨平台特性。它通过模型量化、计算图优化和异构计算等技术,在移动设备和嵌入式系统中实现高效推理。主要功能涵盖模型转换、硬件加速、内存优化及多模型支持,广泛应用于图像识别、语音处理、智能家居及工业检测等领域。

VPP

VPP(Video Prediction Policy)是清华大学与星动纪元联合开发的AIGC机器人模型,基于视频扩散模型实现未来场景预测与动作生成。支持高频预测与跨机器人本体学习,显著降低对真实数据的依赖。在复杂任务中表现出色,适用于家庭、工业、医疗、教育等多个领域。其开源特性推动了具身智能机器人技术的发展。

豆包大模型1.5

豆包大模型1.5是字节跳动推出的高性能AI模型,采用大规模稀疏MoE架构,具备卓越的综合性能和多模态能力。支持文本、语音、图像等多种输入输出方式,适用于智能辅导、情感分析、文本与视频生成等场景。模型训练数据完全自主,性能优于GPT-4o和Claude 3.5 Sonnet等主流模型,且具备成本优势。

VoiceCraft

VoiceCraft是一款开源的神经编解码器语言模型,专攻零样本语音编辑和文本到语音(TTS)任务。它采用Transformer架构,通过token重排过程结合因果掩蔽和延迟叠加技术,实现在现有音频序列内高效生成自然的语音。VoiceCraft在多种口音、风格和噪声条件下表现出色,适用于有声读物制作、视频内容创作、播客音频编辑及多语言内容生产等场景。

Pixelied

Pixelied是一款基于浏览器的在线图形设计工具,提供丰富的模板库、版权免费的照片与图标资源以及一键背景移除等功能。用户可在线完成图片编辑、格式转换等任务,并利用其强大的AI图像生成技术实现高效创作。产品适用于社交媒体营销、内容创作、品牌推广等多个领域,支持团队协作,满足多样化视觉需求。

TECHSPECS

TechSpecs Ray是一款由AI驱动的媒体播放器,主要功能包括实时多语言字幕生成与翻译、智能媒体搜索及分类、主流流媒体平台集成等。它支持上千种媒体格式,可跨多平台运行,致力于消除语言壁垒,提升全球用户的媒体访问体验。

Paradot

Paradot是一款基于先进自然语言处理技术的AI伴侣应用,支持用户定制化AI伴侣的性格、声音和外观。它具备记忆功能,能记住用户的兴趣和过往对话,提供连贯且个性化的互动体验。除了情感支持和社交陪伴,Paradot还兼具信息查询、创意激发以及语言学习等功能,适用于情感陪伴、社交练习、语言学习等多个场景,致力于提升用户的数字生活质量。

easypic

Easypic 是一款基于人工智能的在线图片处理工具,专为快速去除图片背景而设计。它支持多种图片格式和应用场景,如人像、电商产品、动植物及设计元素等。工具具备高效的AI抠图能力,可保持图像主体完整性,并提供背景替换和高清导出功能。目前,Easypic 为用户提供免费服务,适合各类图像编辑需求。

Joy industrial

Joy Industrial是京东工业推出的行业首个以供应链为核心的工业大模型,基于“工业大模型+供应链场景应用”双引擎,构建全栈产品矩阵。该模型提供需求代理、运营代理、商品专家、集成专家、关务代理等AI产品,解决数据孤岛、协同冲突等问题,助力产业降本增效、合规保供,推动产业链结构性变革,支持制造业供应链优化、商品质量与合规管理、企业数字化转型及出海支持等场景。