OmniVision OmniVision是一款面向边缘设备的紧凑型多模态AI模型,参数量为968M。它基于LLaVA架构优化,能够处理视觉与文本输入,显著降低计算延迟和成本。OmniVision支持视觉问答、图像描述等功能,广泛应用于内容审核、智能助手、视觉搜索等领域。 AI项目与工具 2025年06月12日 37 点赞 0 评论 487 浏览
Colorify Rocks Colorify Rocks是一款利用AI技术生成个性化颜色组合的在线工具,可依据用户输入的关键词或主题快速产出协调美观的颜色方案,广泛应用于平面设计、网页设计、品牌策划及室内装饰等领域,同时提供丰富的颜色属性信息以启发用户创意。 AI项目与工具 2025年06月12日 93 点赞 0 评论 486 浏览
PromptFolder 专为大型语言模型 (LLM)和大型模型 (LM) 以及LMOps设计的提示词优化助手,不管是文字、还是图片的提示词,都可以一键优化。 Ai提示指令 2025年06月05日 14 点赞 0 评论 485 浏览
Edify 3D Edify 3D 是 NVIDIA 推出的一款高效3D资产生成工具,能够从文本或图像输入快速生成高质量的3D模型。其主要功能包括支持文本到3D、图像到3D的转换,生成高分辨率纹理与 PBR 材质,并具备快速生成、UV贴图和材质图生成等特性。该工具通过多视图扩散模型、Transformer 模型及跨视图注意力机制实现精准建模,适用于游戏开发、虚拟现实、影视制作及建筑可视化等多个领域。 AI项目与工具 2025年06月12日 40 点赞 0 评论 485 浏览
Wisecut Wisecut 是一款利用人工智能技术的在线视频编辑工具,其核心功能包括 AI 高光检测、自动字幕生成与多语言翻译、基于语音的故事板编辑、智能背景音乐匹配以及静音段落自动移除等。它特别适合用于社交媒体内容创作、视频博客、在线教育、产品营销和企业培训等领域,帮助用户快速制作高质量的短视频或音频内容。 AI项目与工具 2025年06月12日 26 点赞 0 评论 483 浏览
VRAG VRAG-RL是阿里巴巴通义大模型团队推出的视觉感知驱动的多模态RAG推理框架,旨在提升视觉语言模型在处理视觉丰富信息时的检索、推理和理解能力。通过定义视觉感知动作空间,实现从粗粒度到细粒度的信息获取,并结合强化学习和综合奖励机制优化模型性能。该框架支持多轮交互推理,具备良好的可扩展性,适用于智能文档问答、视觉信息检索、多模态内容生成等多种场景。 AI项目与工具 2025年06月11日 84 点赞 0 评论 483 浏览
从容大模型 从容大模型是云从科技推出的多模态AI模型,在国际评测中表现优异,具备视觉语言理解与推理能力。其核心技术包括多模态对齐、高效工程优化和原生多模态推理,支持复杂场景下的文本识别和开放域问答。该模型在医学健康、金融、制造、政务等多个领域实现规模化应用,助力智能化转型。 AI项目与工具 2025年06月11日 21 点赞 0 评论 482 浏览
EarnBetter EarnBetter是一个利用人工智能技术来帮助求职者加速求职过程的平台。它提供了一系列的工具和服务,旨在帮助用户从简历制作到面试准备的各个环节。 创作工具 1970年01月01日 0 点赞 0 评论 482 浏览
ScienceOne ScienceOne是由中国科学院自动化研究所研发的智能科研平台,基于科学基础大模型,支持科研全流程的智能化管理。平台包含S1-Literature文献助手和S1-ToolChain科学工具调度台,分别用于文献综述生成、论文精读辅助及跨学科工具协同调用,提升科研效率与质量。 AI项目与工具 2025年06月11日 100 点赞 0 评论 481 浏览