服务器详情
这是一个将 OmniParser 的视觉解析能力与 PyAutoGUI 自动化操作结合的 MCP 服务。简单来说,它让 AI 拥有了“眼睛”和“手”:AI 能通过屏幕截图识别界面上的按钮、输入框等元素,并直接模拟鼠标点击和键盘输入来操控你的电脑。对于需要处理复杂 GUI 软件、无法通过 API 接入的陈旧系统,或者想要实现全自动网页/应用操作的开发者来说,这是一个极佳的桥梁。它将原本碎片化的视觉识别与执行步骤统一到了 MCP 标准下,显著降低了构建 AI Agent 操控桌面的门槛。
一个提供 NON906/omniparser-autogui-mcp 能力的模型上下文协议服务器,可被兼容 MCP 的 AI 客户端连接和调用。
收录本 MCP 服务的合集
工具测试
non906-omniparser-autogui-mcp
调用 NON906/omniparser-autogui-mcp 提供的 MCP 能力并返回结构化结果。
input根据该 MCP 服务的工具 schema 传入参数。连接方式
{
"mcpServers": {
"NON906/omniparser-autogui-mcp": {
"url": "部署后由服务提供方生成 Remote 地址"
}
}
}Remote 地址需要在部署后由服务提供方生成,页面不会伪造不可用的端点。
当前记录没有 npm 包,请先打开来源仓库补充 command 和 args。如果当前条目没有登记 npm 包,请以来源仓库的安装方式为准。
如何使用
- 01步骤 1
先检查服务器能力和权限范围。
- 02步骤 2
复制安装命令或 JSON 配置。
- 03步骤 3
在客户端中进行小范围连接测试。
- 04步骤 4
确认数据访问和维护状态后再长期使用。
讨论与反馈
这里保留讨论入口,方便继续核对来源、使用体验和维护状态。
前往来源页面