图像生成 - 智狐AI导航

Fotographer AI

Fotographer AI是一款基于AI技术的图像生成工具，能够快速生成专业级产品图像，并提供多样化的广告模特图像。该工具支持文本和模板定制，简化创作流程。此外，它还能即时生成博客、新闻稿等营销材料。试用期免费，同时提供企业级服务选项，包括图像生成和账户管理。

AI项目与工具 2025年06月12日 26 点赞 0 评论 863 浏览

Half_illustration

Half_illustration 是一款基于 Flux.1 模型的 LoRA 图像创意工具，融合了摄影写实与插画艺术的元素，创造出独特的视觉效果。该工具支持通过 API 快速生成图像，并与 Diffusers 库兼容。用户可通过详细描述和特定提示词指导模型，实现个性化的艺术创作。其应用广泛，涵盖时尚编辑、广告设计、概念艺术等多个领域。

AI项目与工具 2025年06月12日 55 点赞 0 评论 503 浏览

AuraFlow

AuraFlow v0.1是一款由Fal团队开发的开源AI文生图模型，拥有6.8B参数量。该模型通过优化的MMDiT架构提升了计算效率和可扩展性。AuraFlow在生成精确图像方面表现出色，特别是在物体空间构成和色彩表现上具有优势。此外，它采用了最大更新参数化技术，增强了学习率迁移的稳定性。AuraFlow支持文本到图像的生成，适用于艺术创作、媒体内容生成、游戏开发及广告和营销等多种应用场景。

AI项目与工具 2025年06月12日 35 点赞 0 评论 910 浏览

Transfusion是由Meta公司开发的多模态AI模型，能够同时生成文本和图像，并支持图像编辑功能。该模型通过结合语言模型的下一个token预测和扩散模型，在单一变换器架构上处理混合模态数据。Transfusion在预训练阶段利用了大量的文本和图像数据，表现出强大的扩展性和优异的性能。其主要功能包括多模态生成、混合模态序列训练、高效的注意力机制、模态特定编码、图像压缩、高质量图像生成、文本生成

AI项目与工具 2025年06月12日 26 点赞 0 评论 576 浏览

DistriFusion

DistriFusion是一个专为加速高分辨率扩散模型在多GPU环境中生成图像的分布式并行推理框架。通过将图像分割成多个小块并分配至不同设备上进行独立处理，它能够在不增加额外训练负担的情况下，将推理速度提升高达六倍，同时保持图像质量。其技术原理包括Patch Parallelism（分片并行）、异步通信、位移补丁并行性等，适用于多种现有的扩散模型。应用场景包括AI艺术创作、游戏和电影制作、VR/A

AI项目与工具 2025年06月12日 50 点赞 0 评论 553 浏览

Imagine Yourself

Imagine Yourself是一款由Meta公司开发的个性化AI图像生成模型，无需针对特定用户进行调整即可生成高质量、多样化的图像。该模型采用了合成配对数据生成和并行注意力架构，提升了图像质量和文本对齐的准确性。主要功能包括无需特定微调、生成合成配对数据、并行注意力架构以及多阶段微调过程。应用场景广泛，包括社交媒体个性化、虚拟试衣间、游戏和虚拟现实、广告和营销以及艺术创作辅助。

AI项目与工具 2025年06月12日 15 点赞 0 评论 634 浏览

Freepik Mystic

Freepik Mystic是一款由Magnific AI和Freepik合作开发的AI图像生成工具，它能够生成高分辨率（1,664 x 2,432）的全高清图像，涵盖写实肖像、动物、风景、奇幻场景、室内设计、建筑概念、像素艺术、游戏元素和表情包等多种类型。图像由顶尖艺术家策划并经过微调优化，确保高质量输出。用户可以通过Freepik Premium订阅使用该工具，并期待其未来集成到Magnifi

AI项目与工具 2025年06月12日 95 点赞 0 评论 754 浏览

CogView

CogView-3-Plus是智谱AI研发的AI文生图模型，采用Transformer架构替代传统的UNet，优化了扩散模型中的噪声规划。它能够根据用户指令生成高质量、高美学评分的图像，支持多种分辨率，并具有实时生成图像的能力。该模型已被集成到“智谱清言”APP中，并提供API服务，适用于艺术创作、游戏设计、广告制作等多个图像生成领域。

AI项目与工具 2025年06月12日 64 点赞 0 评论 795 浏览

auto

Auto-Video-Generator是一款基于AI的自动解说视频生成工具，能够一键生成解说视频。通过输入主题，系统自动生成解说脚本、合成语音、生成配图并完成视频合成，大幅提高内容创作效率。该工具适用于自媒体、营销、教育、新闻媒体及社交媒体等多个领域，帮助用户快速制作高质量视频。

AI项目与工具 2025年06月12日 58 点赞 0 评论 758 浏览

MUMU

MUMU是一种多模态图像生成模型，通过结合文本提示和参考图像来生成目标图像，提高生成的准确性和质量。该模型基于SDXL的预训练卷积UNet，并融合了视觉语言模型Idefics2的隐藏状态。MUMU能够在风格转换和角色一致性方面展现强大的泛化能力，同时在生成图像时能够很好地保留细节。主要功能包括多模态输入处理、风格转换、角色一致性、细节保留以及条件图像生成。

AI项目与工具 2025年06月12日 58 点赞 0 评论 565 浏览

图像生成

首页

图像生成

列表

默认

浏览次数

发布日期