自动化

ShowUI

ShowUI是一款由新加坡国立大学Show Lab与微软合作开发的视觉-语言-行动模型,旨在提升图形用户界面(GUI)助手的工作效率。该模型通过UI引导的视觉令牌选择、交错视觉-语言-行动流以及高质量数据集的运用,实现了高效的零样本截图定位和GUI自动化功能,广泛应用于网页自动化、移动应用测试、桌面软件自动化及游戏自动化等领域。

Merlin AI

一个基于OpenAI的ChatGPT技术的浏览器扩展,Merlin AI能够在用户的浏览器上提供一键访问ChatGPT、GPT-4、Claude和Llama等高级语言模型的功能。

Open Computer Agent

Open Computer Agent 是一款基于云端的 AI 工具,支持在 Linux 虚拟机中运行,能通过自然语言指令完成多种任务。结合视觉模型实现界面元素识别与交互,具备任务自动化、多任务处理能力,并提供云托管服务,适用于办公、教育、数据收集等场景。

Atomic Agents

一个适用于构建模块化、可扩展的AI代理开源框架,它将复杂的AI系统分解为最小的、不可分割的组件,并通过这些组件的灵活组合来构建强大的 AI 应用。

谜境

谜境是一款基于AI技术的互动剧本创作工具,支持从剧本大纲、人物设定到分镜脚本的自动生成,具备自动配音、配乐及多样化互动设计功能。用户只需输入关键词即可快速构建完整故事框架,支持灵活修改与优化。适用于互动小说、游戏开发、剧本杀、教育等多个领域,有效降低创作门槛,提升创作效率与沉浸式体验。

Copilot Actions

Copilot Actions是微软推出的一款基于AI的自动化工具,隶属于Microsoft 365 Copilot。它支持用户通过简单提示完成日常重复性任务,如会议总结、报告生成及邮件分类等。通过预设模板和规则,AI能自动执行任务,提升工作效率,帮助用户集中精力处理高价值工作。目前该功能处于私人预览阶段。

DeepSeek Engineer

DeepSeek Engineer 是一款基于命令行的 AI 编程辅助工具,集成 DeepSeek API 提供文件操作功能。它通过 Pydantic 实现类型安全,支持 JSON 格式输出,可读取、创建和编辑本地文件,适用于代码审查、文档生成、实时协作和自动化测试等多种应用场景。

fynk

fynk 是一款基于AI技术的合同管理工具,支持合同全生命周期管理,包括起草、审查、签署、分析与跟踪。其核心功能包括自动化合同分析、可定制审查规则、数据分析与风险预警,适用于多种商务文档。该工具能够提升合同处理效率,优化工作流程,广泛应用于法务、采购、销售、金融及房地产等领域,助力企业实现合规与高效运营。

OfficeAI助手

OfficeAI助手是一款面向Microsoft Office和WPS用户的智能办公工具,集成WordAI和ExcelAI插件,提供文档撰写、数据分析、格式优化等功能。支持AI对话、智能校对、自动排版、公式推荐、图表生成等,提升办公效率。具备本地部署、多语言支持与跨平台兼容性,适用于各类办公场景。

PPTAgent

PPTAgent是由中国科学院软件研究所研发的AI驱动演示文稿生成工具,采用两阶段编辑方法,从文档自动生成结构清晰、内容一致的PPT。它结合大型语言模型与幻灯片分析技术,支持大纲生成、内容编辑与质量评估,适用于教育、企业、市场等多个场景,显著提升演示文稿制作效率与质量。