图像生成 - 智狐AI导航

SimpleAR

SimpleAR是一款由复旦大学与字节跳动联合研发的纯自回归图像生成模型，采用简洁架构实现高质量图像生成。其通过“预训练-有监督微调-强化学习”三阶段训练方法，提升文本跟随能力与生成效果。支持文本到图像及多模态融合生成，兼容加速技术，推理速度快。适用于创意设计、虚拟场景构建、多模态翻译、AR/VR等多个领域。

AI项目与工具 2025年06月11日 76 点赞 0 评论 693 浏览

ImagePulse

ImagePulse是由魔搭社区推出的开源项目，专注于图像理解和生成模型的数据集支持。它通过将复杂任务拆解为“修改、添加、移除”“风格迁移”“人脸保持”等原子能力，构建专门的数据集，提升模型在特定任务上的性能。项目提供开源脚本，支持数据集的生成与扩展，并结合多种技术资源实现多模型协同，适用于艺术创作、视频制作、产品展示等多个领域。

AI项目与工具 2025年06月11日 71 点赞 0 评论 461 浏览

GigaTok

GigaTok 是一款基于语义正则化的高参数视觉分词器，支持自回归图像生成，具备优异的图像重建与生成能力。通过一维架构和非对称扩展策略，实现高效计算与稳定训练。适用于图像生成、编辑、数据增强及多模态应用，具有广泛的技术拓展性。

AI项目与工具 2025年06月11日 74 点赞 0 评论 866 浏览

InstantCharacter

InstantCharacter是由腾讯混元开发的图像生成插件，基于扩散 Transformer 架构，支持角色一致性保持、高保真图像生成及文本可控性。用户可通过输入角色图片和文字描述，生成符合要求的多样化图像。其适用于连环画、影视、游戏等多个领域，具有高效、灵活和高质量的特点。

AI项目与工具 2025年06月11日 94 点赞 0 评论 566 浏览

Ghiblio.art

Ghiblio.art 是一款AI图像生成工具，可将文字或照片转化为吉卜力风格的艺术作品。支持多种图像类型，生成高分辨率、细节丰富的图像，适用于头像、壁纸及艺术创作。操作简单，处理迅速，还可选择新海诚和皮克斯等其他风格，适合个人及商业用途。

AI项目与工具 2025年06月11日 41 点赞 0 评论 595 浏览

Pollinations.AI

Pollinations.AI是一个开源AI内容生成平台，提供图像生成、文本生成、音频转换及视觉分析等功能。用户无需注册即可使用，支持多种模型和参数配置，适合开发者和创作者快速集成与应用。平台还提供浏览器开发环境，简化了使用流程，提升了效率。

AI项目与工具 2025年06月11日 50 点赞 0 评论 747 浏览

WaveSpeedAI

WaveSpeedAI 是一款集图像与视频生成于一体的 AI 平台，提供多个高性能模型，支持高质量图像生成、个性化风格定制及视频内容创作。平台具备超快速生成能力，适用于创意设计、广告制作和视频内容生产等领域，提供易用接口和企业级部署选项。

AI项目与工具 2025年06月11日 40 点赞 0 评论 691 浏览

MiniMax MCP Server

MiniMax MCP Server 是一款基于 MCP 协议的多模态生成服务器，支持视频、图像、语音及声音克隆等功能。其具备高分辨率输出、自然语音生成与声音克隆能力，兼容多种主流客户端。平台采用客户端-服务器架构，结合 RAG 技术提升响应准确性，适用于教学、游戏开发、内容创作等多个领域。

AI项目与工具 2025年06月11日 14 点赞 0 评论 822 浏览

PixelFlow

PixelFlow是由香港大学与Adobe联合开发的图像生成模型，支持在像素空间中直接生成高质量图像。其基于流匹配技术和多尺度生成策略，实现从低分辨率到高分辨率的逐步生成，有效降低计算成本。该模型在类别条件图像生成和文本到图像生成任务中表现优异，具备强大的语义理解和视觉表达能力。此外，PixelFlow采用端到端训练方式，支持多种ODE求解器，适用于艺术设计、内容创作、教育研究等多个领域。

AI项目与工具 2025年06月11日 100 点赞 0 评论 413 浏览

UNO

UNO是字节跳动推出的AI图像生成框架，支持单主体和多主体图像生成，解决多主体一致性难题。采用扩散变换器和渐进式跨模态对齐技术，结合通用旋转位置嵌入（UnoPE），实现高一致性与可控性。适用于虚拟试穿、产品设计、创意设计等多个领域，具备强大泛化能力，已开源并提供完整技术文档。

AI项目与工具 2025年06月11日 23 点赞 0 评论 798 浏览

图像生成

首页

图像生成

列表

默认

浏览次数

发布日期