图像 - 智狐AI导航

改图鸭

改图鸭是一个在线图片处理工具，用户无需下载、安装任何程序，即可在线对图片进行多种编辑处理。它拥有多功能图片处理功能，如图片编辑、图片格式转换、证件照制作、图片变漫画、...

创作工具 1970年01月01日 0 点赞 0 评论 677 浏览

Gemini

Gemini是Google DeepMind推出的全新AI模型，集成了多模态推理功能，超越了以往模型的性能，适用于科学文献洞察、竞争性编程等多种应用场景。

Ai平台模型 2025年06月05日 100 点赞 0 评论 677 浏览

FastVLM

FastVLM是一款高效的视觉语言模型，采用FastViTHD混合视觉编码器，显著提升高分辨率图像处理速度并减少token数量。其在保持高性能的同时，降低了计算成本和模型复杂度。适用于视觉问答、图文匹配、文档理解、图像描述生成等多模态任务，具备良好的实用性和扩展性。

AI项目与工具 2025年06月11日 85 点赞 0 评论 676 浏览

腾讯混元游戏

腾讯发布的混元游戏视觉生成平台，这是依托混元大模型打造的首个工业级AIGC游戏内容生产引擎，可以优化游戏资产生成与游戏制作流程。

3D&游戏 2025年06月05日 38 点赞 0 评论 675 浏览

SauceNAO

一个以图搜图的反向图像搜索引擎，主要功能是帮助用户找到图片的来源、作者和相关信息。它特别适用于动漫、漫画、游戏等领域的图片搜索。

免商图片 2025年06月05日 45 点赞 0 评论 675 浏览

TextHarmony

TextHarmony是一款由华东师范大学与字节跳动联合开发的多模态生成模型，擅长视觉与文本信息的生成与理解。该模型基于Slide-LoRA技术，支持视觉文本生成、编辑、理解及感知等功能，广泛应用于文档分析、场景文本识别、视觉问题回答、图像编辑与增强以及信息检索等领域。通过高质量数据集的构建与多模态预训练，TextHarmony在视觉与语言生成任务中表现出色。

AI项目与工具 2025年06月12日 47 点赞 0 评论 674 浏览

PaliGemma 2

PaliGemma 2是一款由Google DeepMind研发的视觉语言模型（VLM），结合了SigLIP-So400m视觉编码器与Gemma 2语言模型，支持多种分辨率的图像处理。该模型具备强大的知识迁移能力和出色的学术任务表现，在OCR、音乐乐谱识别以及医学图像报告生成等方面实现了技术突破。它能够处理多模态任务，包括图像字幕生成、视觉推理等，并支持量化和CPU推理以提高计算效率。

AI项目与工具 2025年06月12日 10 点赞 0 评论 674 浏览

Cobra

Cobra是由清华大学、香港中文大学和腾讯ARC实验室联合开发的漫画线稿上色框架，采用因果稀疏注意力机制和局部可复用位置编码技术，实现高精度、高效率的自动上色。支持颜色提示调整，提升灵活性与个性化。适用于漫画、动画、插画等多种场景，具有高效的推理能力和良好的扩展性。项目已开源，包含技术论文与模型资源。

AI项目与工具 2025年06月11日 21 点赞 0 评论 674 浏览

Krikey AI

【免费试用】Krikey AI允许用...

Ai绘画生成 1970年01月01日 0 点赞 0 评论 674 浏览

Almaginate-增强版MJ

Almaginate作为一个AI创作平台，通过提供图像生成、风格转换和创意启发等功能，帮助用户以新颖的方式进行艺术创作。它可能特别适合那些寻求创新创作方法的艺术家和设计师。