图像生成 - 智狐AI导航

Smart PDFs

Smart PDFs 是一款免费开源的 AI 工具，用于快速提取和总结 PDF 文档的关键信息。它支持学术论文、行业报告和技术文档等多种格式，可在数秒内生成结构清晰的章节式摘要。工具采用 Llama 3.3 模型进行智能处理，并支持图像生成和内容分享功能，适用于学术、职场和个人使用场景。

AI项目与工具 2025年06月11日 61 点赞 0 评论 494 浏览

ResAdapter

ResAdapter是一种专为扩散模型设计的分辨率适配器，允许图像生成模型生成任意分辨率和宽高比的图像，同时保持原始风格。其主要功能包括分辨率插值、分辨率外推、域一致性、即插即用设计以及广泛的兼容性。通过在扩散模型中插入ResCLoRA和引入ResENorm，ResAdapter能够在不影响模型风格的情况下扩展其分辨率范围。

AI项目与工具 2024年01月01日 70 点赞 0 评论 493 浏览

Anime Art

Anime Art 是一款基于AI技术的动漫风格图像生成工具，用户可通过文本描述或图片输入生成个性化艺术作品。支持多种AI模型和艺术风格选择，同时集成AI聊天功能，适用于角色扮演和文本互动场景。该工具可用于个人创作、社交媒体、教育、商业营销及游戏影视开发等领域，具有广泛的适用性和创造性价值。

AI项目与工具 2025年06月12日 31 点赞 0 评论 492 浏览

InfiniteYou

InfiniteYou 是由字节跳动推出的基于扩散变换器的身份保持图像生成框架，通过 InfuseNet 注入身份特征，确保生成图像与输入图像的高度相似。结合多阶段训练策略，提升文本与图像对齐、图像质量和美学效果。支持插件化设计，兼容多种工具，适用于社交媒体、影视制作、广告营销等多个领域。

AI项目与工具 2025年06月12日 79 点赞 0 评论 492 浏览

Sider

Sider是一款基于AI技术的多功能浏览器扩展程序，集成了多种先进模型（如GPT-4o、Claude 3.5等），提供智能聊天、写作辅助、阅读总结、多语言翻译、代码支持及图像生成等功能。无论是学术研究、内容创作还是日常阅读，Sider都能有效提升用户的信息处理能力和工作效率。

AI项目与工具 2025年06月12日 53 点赞 0 评论 491 浏览

ELLA（Efficient Large Language Model Adapter）是一种由腾讯研究人员开发的方法，旨在提升文本到图像生成模型的语义对齐能力。它通过引入时序感知语义连接器（TSC），动态提取预训练大型语言模型（LLM）中的时序依赖条件，从而提高模型对复杂文本提示的理解能力。ELLA无需重新训练，可以直接应用于预训练的LLM和U-Net模型，且能与现有模型和工具无缝集成，显著提升

AI项目与工具 2024年01月01日 74 点赞 0 评论 490 浏览

AIEasyPic

利用了如Stable Diffusion、ControlNet和LoRAs等模型，根据您的文本输入生成视觉效果。

Ai绘画生成 2025年06月05日 76 点赞 0 评论 488 浏览

Le Chat APP

Le Chat APP是一款由Mistral AI推出的AI对话工具，支持自然语言交互、实时搜索、文档分析与图像生成。提供免费基础版和付费Pro版，支持多语言及移动端使用，适用于学习、旅行规划、创意激发等多种场景。

AI项目与工具 2025年06月12日 51 点赞 0 评论 487 浏览

混元图像2.0

混元图像2.0是腾讯开发的AI图像生成工具，支持文本、语音、草图等多种输入方式，具备实时生成能力。其采用单双流DiT架构和多模态大语言模型，生成图像写实性强、细节丰富，且响应速度快，适用于创意设计、广告营销、教育、游戏等多个领域。用户可通过网页端直接操作，实现高效的图像创作体验。

AI项目与工具 2025年06月11日 41 点赞 0 评论 487 浏览

VMix

VMix是一款提升文本到图像生成美学质量的工具，通过解耦文本内容与美学描述，并引入细粒度美学标签，增强图像在色彩、光线、构图等方面的视觉表现。其核心技术为交叉注意力混合控制模块，可在不改变原有模型结构的情况下注入美学条件，保持图文一致性。VMix兼容多种扩散模型及社区模块，支持多源输入、高质量视频处理、实时直播与远程协作，广泛应用于电视直播、网络直播、现场活动及虚拟演播室等场景。

AI项目与工具 2025年06月12日 97 点赞 0 评论 486 浏览

图像生成

首页

图像生成

列表

默认

浏览次数

发布日期