阿里巴巴 - 智狐AI导航

Animate Anyone

Animate Anyone是一款由阿里巴巴智能计算研究院开发的开源框架，旨在将静态图像中的角色或人物动态化。它采用扩散模型，结合ReferenceNet、Pose Guider姿态引导器和时序生成模块等技术，确保输出的动态视频具有高度一致性和稳定性。该框架支持多种应用，包括角色动态化、时尚视频合成及人类舞蹈生成，用户可通过GitHub或Hugging Face社区轻松体验。

AI项目与工具 2025年06月12日 19 点赞 0 评论 921 浏览

MinMo

MinMo是阿里巴巴通义实验室推出的多模态语音交互大模型，具备高精度语音识别与生成能力。支持情感表达、方言转换、音色模仿及全双工交互，适用于智能客服、教育、医疗等多个领域，提升人机对话的自然度与效率。

AI项目与工具 2025年06月12日 59 点赞 0 评论 899 浏览

AlibabaWOOD

AlibabaWood通过融合电商视频设计与人工智能，为商家提供了一个高效、智能的视频创作解决方案。它不仅能提升商品的成交和曝光率，还能增加店铺访客数和总成交量。

Ai视频生成 2026年06月27日 0 点赞 0 评论 826 浏览

绘蛙AI多图成片

阿里巴巴推出的一款AI图生视频工具，只需上传2-4张连贯的图片并结合文字描述，就可快速生成一段流畅自然的视频。

Ai视频生成 2025年06月05日 48 点赞 0 评论 815 浏览

QwenLong

QwenLong-L1-32B是阿里巴巴集团Qwen-Doc团队开源的首个长文本推理大模型，基于渐进式上下文扩展、课程引导的强化学习和难度感知的回顾性采样策略，显著提升长文本场景下的推理能力。该模型在多个DocQA基准测试中表现优异，平均准确率达70.7%，超越多个现有旗舰模型。其功能包括长文本推理、稳定训练、混合奖励、广泛适用性和高性能表现，适用于法律、金融、科研等多个领域。

AI项目与工具 2025年06月11日 24 点赞 0 评论 793 浏览

顽图抠图

顽兔抠图是阿里巴巴出品的一款在线智能批量抠图工具

Ai图片处理 2025年06月05日 88 点赞 0 评论 781 浏览

OmniTalker

OmniTalker 是一款由阿里巴巴开发的实时多模态交互技术，支持文本、图像、音频和视频的同步处理，并能生成自然流畅的语音响应。其核心技术包括 Thinker-Talker 架构和 TMRoPE 时间对齐技术，实现音视频精准同步与高效流式处理。适用于智能语音助手、内容创作、教育、客服及工业质检等场景，具有高实时性与稳定性。

AI项目与工具 2025年06月12日 59 点赞 0 评论 719 浏览

imgcook图像大厨

imgcook是阿里巴巴前端委员会智能化小组的服务化的内外落地产品，通过智能化技术一键生成可维护的前端代码

Ai编程建站 2025年06月05日 45 点赞 0 评论 695 浏览

VACE

VACE是由阿里巴巴通义实验室推出的视频生成与编辑框架，支持文本到视频、参考生成、视频扩展、遮罩编辑等多种任务。其核心是Video Condition Unit（VCU），可整合多模态输入，实现任务灵活组合。支持480P和720P分辨率，适用于创意视频制作、视频修复、风格转换及互动创作等场景，具备高灵活性和广泛的应用潜力。

AI项目与工具 2025年06月12日 33 点赞 0 评论 675 浏览

DreamTalk

一个由清华大学、阿里巴巴和华中科大共同开发的一个基于扩散模型可以让人物照片说话，支持包括歌曲、多种语言的语音、嘈杂的音频在内的各种声音匹配让人物头像说话的框架。

Ai开源项目 2025年06月05日 98 点赞 0 评论 654 浏览

阿里巴巴

首页

阿里巴巴

列表

默认

浏览次数

发布日期