R

掌上识别王

一款功能丰富的文字识别和图片转文字的工具类软件,掌上识别王能够实现高精度的文字识别,支持多种图片格式和文档。

DropSeek

一款专注于Shopify平台的免费工具,用于将产品从 Aliexpress 或 Amazon 导入到您的 Shopify 商店的免费工具。

Moonvy提示词可视化

这是一个旨在把 AIGC 提示词(现在支持 Midjourney和Stable Diffusion)可视化并提供编辑功能的工具,主要用于AI绘画领域

POINTS 1.5

POINTS 1.5 是腾讯微信开发的多模态大模型,基于LLaVA架构设计,包含视觉编码器、投影器和大型语言模型。它在复杂场景OCR、推理、关键信息提取、数学问题解析及图片翻译等方面表现突出,适用于票据识别、自动客服、新闻摘要、学术论文处理、旅游翻译和在线教育等多个领域。该模型通过高效的数据处理和特征融合技术,实现了跨模态任务的精准处理与高效输出。

云吧Ai绘画

集结了多个AI绘图工具的地方,包括StableDiffusion、Midjourney和AI大语言模型等。

MagicEraser.Pro

一款免费在线 AI 图片去物体工具,支持无限次免费使用,可删除照片中的人物、文字、水印、背景杂物、瑕疵等元素。

CloneUI

一款强大的AI驱动的图片转代码工具,能够将截图、网址或 Figma 设计一键转换为 React、Vue 或 HTML/CSS 代码。

Vizard AI

一款在将长视频转换为适合TikTok、Instagram Reels 和 YouTube Shorts 等社交媒体平台短片的AI视频编辑平台。Vizard AI实现了编辑过程的自动化,帮助用户轻松创建社交媒体内容。

mPLUG

mPLUG-Owl3是一款由阿里巴巴开发的多模态AI模型,专注于理解和处理多图及长视频内容。该模型具备高推理效率和准确性,采用创新的Hyper Attention模块优化视觉与语言信息的融合。它已在多个基准测试中展现出卓越性能,并且其源代码和资源已公开,可供研究和应用。

HOVER

HOVER是一款由英伟达研发的1.5M参数量的小型模型,专注于人形机器人复杂动作的控制。其核心功能涵盖多模式控制、运动学位置跟踪、关节角度跟踪及统一命令空间设计,通过策略蒸馏与模拟训练实现高效技能迁移,广泛应用于导航、桌面操作、移动操作及远程操控等场景。