图像

Step-1V

覆盖了从个人使用到企业级应用的多个方面的多模态大模型。

一设MJ咒语解析

免费的Midjourney以图生文工具,只需上传一张图片,一设MJ咒语解析就会生成自带中英文翻译提示词。

吱意

吱意是一款可以适用于图片翻译、文档翻译,视频翻译等场景的在线工具。同时,吱意还提供多模态翻译和智能配音,AI写作,AI成画等AIGC人工智能创作等服务。

Img Upscaler

Imgupscaler 是一个使用人工智能来提高照片质量和分辨率的网站。它可以帮助您改善旧图像或低质量图像的外观,或从您的照片中创建令人惊叹的艺术品。

SellerPic.AI

一款专为电商卖家设计的先进AI图片工具。SellerPic.AI使用户能够为其产品生成专业品质的商品像,包括AI生成的时装AI模特和商品图像。

DreamO

DreamO是由字节跳动与北京大学联合开发的图像定制生成框架,基于扩散变换器(DiT)模型实现多条件图像生成。支持身份、风格、背景等条件的灵活集成,具备高质量生成、条件解耦和精准控制能力。适用于虚拟试穿、风格迁移、主体驱动生成等多种场景,具备广泛的适用性和技术先进性。

Blockode AI Photo Studio

Blockode AI Photo Studio。这是一个基于 Web 的工具,可让您根据自拍和提示生成自定义 AI 照片。

LongLLaVA

LongLLaVA是由香港中文大学(深圳)研究团队开发的多模态大型语言模型,结合Mamba和Transformer模块,利用2D池化技术压缩图像token,大幅提升处理大规模图像数据的效率。该模型在视频理解、高分辨率图像分析及多模态代理任务中表现优异,特别擅长检索、计数和排序任务。其技术亮点包括渐进式训练策略和混合架构优化,支持多种多模态输入处理,广泛应用于视频分析、医学影像诊断、环境监测等领域。