# DesktopCommander MCP

> 桌面自动化技能包——基于 MCP 理念封装文件系统操作、终端命令执行、代码管理与桌面操控的标准流程。将零散的桌面操作规范化为可复用的操作 SOP。

- Skill: `ambin-d/desktopcommander-mcp` (Agent Skill)
- Install (CLI): `npx skillmds@latest add ambin-d/desktopcommander-mcp`
- Raw SKILL.md: https://api.skillmd.com/api/skills/ambin-d/desktopcommander-mcp/raw
- Safety review: pending
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: AI & ML
- Author: ambin-d (https://skillmd.com/u/ambin-d)
- Updated: 2026-09-17
- Page: https://skillmd.com/skills/ambin-d/desktopcommander-mcp

---


# DesktopCommander MCP（桌面自动化操作 SOP）

> **跨平台说明：** 本技能所列工具名为Agent A环境专用（exec_quick_command / file_search / browser_open 等）。迁移到其他 Agent 环境（如其他 Agent）时，需将工具名替换为对应平台的等效实现。

本技能定义了 Agent 执行桌面自动化操作的标准程序。核心思路：**把每一次桌面操作当成一个 MCP 调用——发起→执行→验证→报告**。

## 核心原则

- **先规划再执行**：操作前用工具探测目标状态（文件存在？进程在跑？目录结构？）
- **最小权限原则**：只做用户要求的操作，不做额外猜测动作
- **操作后立即验证**：文件操作后检查存在/内容，命令执行后检查退出码
- **失败的替代路径**：一种方法失败后至少尝试一种完全不同路径（PowerShell → cmd → 模拟按键）

## 操作分类

### 1. 文件系统操作
| 操作 | 推荐工具 | 验证方式 |
|------|---------|---------|
| 读取文件 | exec_quick_command (type/Get-Content) | 检查 stdout 非空 |
| 搜索文件 | file_search | 检查结果列表 |
| 创建/写入 | 直接工具写入 | 用 exec_quick_command 验证文件存在 |
| 修改/编辑 | 读原内容→修改→写回 | diff 对比 |
| 批量处理 | PowerShell 脚本 | 逐项验证 |

### 2. 终端命令执行
| 操作 | 推荐工具 | 注意事项 |
|------|---------|---------|
| 轻量查询 | exec_quick_command | 10s 超时，只读 |
| 重型操作 | find_tool → exec_command | 30s+ 超时，可写 |
| 安装/构建 | find_tool → exec_command | **高风险操作，见下方确认流程** |
| 后台进程 | PowerShell Start-Process | 不阻塞当前任务 |

### 3. 桌面与应用操控
| 操作 | 方法 | 说明 |
|------|------|------|
| 浏览器打开 URL | browser_open | 直接打开默认浏览器 |
| 全屏应用 | PowerShell Start-Process `--start-fullscreen` | Edge 全屏模式 |
| 截图 | screenshot（写入 .ps1 脚本后执行） | 沙箱环境特殊处理 |
| 音乐控制 | music_control | 播放/暂停/上下曲 |

## 高风险操作确认流程

删除/覆盖/安装类操作（含批量文件删除、系统级配置修改、软件安装卸载），执行前必须：

1. **展示操作计划** — 一句话说清"要做什么 + 影响范围"（例：删除 C:\temp\test.log / 覆盖 config.yaml 第15-20行）
2. **等待用户确认** — 明确等用户回复"可以/行/确认"后再执行
3. **执行后验证** — 操作完成后验证结果并报告

> 例外：用户明确说"直接干/你看着办/不用问我"时跳过确认，但仍需执行后验证。

## 标准执行流程

### Step 1: 需求解析
- 明确用户要什么操作（文件？命令？桌面？）
- 确定操作范围（单文件？整个目录？批量？）

### Step 2: 环境探测
- 检查目标资源是否存在
- 检查当前状态（进程、文件、网络）
- 确认工具有效性

### Step 3: 执行操作
- 选择最合适的方法
- 若是高风险操作 → 走上方确认流程
- 一次执行到位，不反复试探
- 记录操作过程

### Step 4: 验证结果
- 读取/查看操作结果
- 对比预期与实际
- 有异常走替代路径

### Step 5: 报告
- 一句话说明操作结果
- 有异常如实告知

## 适用场景
- 用户说"帮我打开/关闭/查找/修改 X"
- 多步骤文件整理任务
- 批量命令执行
- 系统状态检查

## 来源
萃取自 Vault 文章《DesktopCommanderMCP：AI Agent 的桌面执行层》，基于 MCP 协议理念封装为本技能。

