# Browser Task

> 浏览器自动化任务处理技能。仅在以下情况使用：1) 其他 skill/工具（搜索、API、数据接口等）都无法满足需求，需要通过真实浏览器 GUI 兜底执行；2) 任务必须在具体网站完成登录 / 授权 / 账号内动作（点赞 / 收藏 / 评论 / 发布 / 加购）；3) 命中白名单网站（淘宝/天猫、微博、小红书）的站内检索 / 互动 / 发布需求。当用户仅需要信息检索、文本生成、代码或数据处理时，不要使用本 skill。

- Skill: `ahang1598/browser-task` (Agent Skill, multi-file: 15 files)
- Install (CLI): `npx skillmds@latest add ahang1598/browser-task`
- Raw SKILL.md: https://api.skillmd.com/api/skills/ahang1598/browser-task/raw
- Safety review: CAUTION (external: skill-scanner PASS, skillspector PASS)
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: Integrations & APIs
- Author: ahang1598 (https://skillmd.com/u/ahang1598)
- Updated: 2026-08-19
- Page: https://skillmd.com/skills/ahang1598/browser-task

---


# GUI 浏览器自动化任务技能

本技能是真实浏览器 GUI 环境下的兜底执行器，专门解决"只能在网页上用鼠标键盘操作才能完成"的任务，并为少数对站内流程高度依赖的白名单网站提供专属子 Skill。

## 触发范围（先判定再进入）

**仅在以下三种情况之一时，才进入本 skill：**

1. **兜底触发**：其他 skill、搜索工具、公开 API、已有结构化数据都无法完成需求，必须通过真实浏览器 GUI 才能完成（例如站内专属信息、必须滚动/点击/等待渲染后才可见的内容、没有开放接口的网页操作）。
2. **登录 / 授权触发**：任务必须在特定网站完成登录、授权、或登录态下的账号内动作（点赞 / 收藏 / 关注 / 评论 / 转发 / 发布 / 加购 / 下单 等）。此时必须走 GUI 才能真实发生。
3. **白名单站点触发**：用户需求明确落在以下白名单网站的站内检索 / 互动 / 发布链路上——这些站点的页面结构与交互需要专属子 Skill 才能稳定执行。

### 白名单（逐步添加；未列入白名单的站点走通用 GUI 流程）

| 站点 | 子 Skill 入口 | 典型触发关键词 |
| :--- | :--- | :--- |
| 淘宝 / 天猫 | [references/taobao-skill.md](references/taobao-skill.md) | 淘宝、天猫、加购 / 加入购物车、比价、选靠谱款、旗舰店 |
| 微博 | [references/weibo-skill.md](references/weibo-skill.md) | 微博、发微博、微博点赞 / 收藏、热点事件、舆情、话题、超话、当事人回应 |
| 小红书 | [references/xiaohongshu-skill.md](references/xiaohongshu-skill.md) | 小红书、笔记、种草、攻略收集、发小红书、点赞 / 收藏 / 评论 / 关注笔记 |

### 禁止使用场景

下列场景必须拒绝进入本 skill，改用更合适的能力或如实告知：

- 纯文本生成、改写、翻译、总结类任务（无需访问任何网页）
- 代码开发 / 代码审查 / 调试类任务
- 已有结构化数据文件（csv/json/excel 等）的数据分析任务
- 可通过开放 API / 官方 SDK / 公共数据源直接获取的信息
- 通用搜索引擎已能满足的事实性检索（除非用户明确要求进入某站点内核实或登录态操作）
- 需要登录第三方平台但无可用凭证且用户也无法协助登录的任务

## 路由（命中触发范围后再执行）

### 第一步：白名单站点优先分流

若用户需求命中白名单，立即交由对应子 Skill 接管，并严格遵守子 Skill 内部的工作流与约束：

- 淘宝 / 天猫相关 → 读取并执行 [references/taobao-skill.md](references/taobao-skill.md)
- 微博相关 → 读取并执行 [references/weibo-skill.md](references/weibo-skill.md)（其内部再引用 [references/weibo/CONSTRAINTS.md](references/weibo/CONSTRAINTS.md)、[references/weibo/FORMAT.md](references/weibo/FORMAT.md)）
- 小红书相关 → 读取并执行 [references/xiaohongshu-skill.md](references/xiaohongshu-skill.md)（其内部再引用 [references/xiaohongshu/collect.md](references/xiaohongshu/collect.md)、[references/xiaohongshu/collect.travel.md](references/xiaohongshu/collect.travel.md)、[references/xiaohongshu/interact.md](references/xiaohongshu/interact.md)、[references/xiaohongshu/publish.md](references/xiaohongshu/publish.md)）

**边界原则（重要）**：

- 当命中白名单时，子 Skill 内部的"平台站内约束"优先级高于下方通用约束（例如：微博子 Skill 要求来源必须来自微博域名，此时不得用通用搜索替代）。
- 当未命中白名单，但任务仍符合触发范围（兜底 / 登录授权）时，执行下方"通用 GUI 工作流"；不要把白名单子 Skill 的站内特化规则套用到其他网站。
- 白名单会逐步扩充；新增站点必须以新增"references/<站点>-skill.md"并在上表登记的方式加入，禁止在通用流程里硬编码站点规则。

### 第二步：通用 GUI 工作流（未命中白名单时使用）

- 无论遇到什么任务，总是先执行下方"前置能力检查"
- 用户要求"点赞/收藏/关注/评论/转发"：执行 [操作验证流程](references/action-verification.md)
- 用户要求"推荐攻略/推荐路线/推荐餐厅"等不含"唯一解"的场景：执行 [非确定性任务处理](references/non-deterministic.md)
- 遇到"按钮点击失败/输入框无法聚焦/下拉菜单打不开"等和页面组件交互相关：执行 [GUI 组件操作](references/gui-components.md)
- 页面出现"数据错误/信息重复/元素遮挡/加载失败"等页面异常相关：执行 [异常处理](references/exception-handling.md)
- 用户要求返回网页信息：执行 [时效性信息获取](references/timeliness-info-acquisition.md)

## 前置能力检查（通用流程必须执行；白名单子 Skill 若已覆盖相应条目可直接沿用）

在执行任何 GUI 任务前，必须按以下顺序完成前置检查。

### 1. Prompt 拆解

完整拆解用户需求中的所有显式约束和隐含约束。

**要求**：
- 识别所有显式要求（功能、格式、数量）
- 识别隐含约束（采集类任务产物不可重复；用户指定的搜索词中也会有隐含约束）
- 明确了关键定义（统计口径、数据来源）
- 理解产物格式（表格、图片、列表）

**执行**：
1. 将用户需求拆分为：主任务 + 次级任务 + 约束条件
2. 明确列出搜索查询的组成成分：
   - 主体实体
   - 关联实体
   - 关系词
   - 时间限定
   - 赛事或活动限定
   - 类型限定
3. 用一句话复述搜索查询结构
4. 对照原需求检查核心限定词完整性
5. 对模糊概念进行澄清（必要时向用户提问）
6. 形成可执行的步骤清单

### 2. 指令遵循与任务追踪

确保所有需求都被完整执行，避免遗漏。

**要求**：
- 列出所有需要执行的步骤
- 跟踪每一步的完成情况
- 多步任务执行时设定状态记录

**执行动作**：
1. 创建任务清单，每完成一步打勾
2. 对于多步任务，记录当前进度（如：已完成 3/10 条）
3. 遇到中断时，保留已完成的成果，不要全部丢弃

### 3. 数据源规范性

严格按照用户指定的数据源进行搜索和统计。

**检查清单**：
- 是否明确了数据来源（平台、页面、关键词）
- 是否理解了统计口径
- 是否避免了编造数据

**执行**：
1. 如果用户未指定数据源，主动询问或选择最权威来源。如果用户指定数据源，例如"请你去xxx网站"，则必须访问用户指定的网站
2. 对于统计类任务，明确定义统计方法
3. 无法获取真实数据时，如实告知，禁止编造

### 4. 样本充分利用

在总结、对比、归纳类任务中，尽可能收集充足样本。

**要求**：
- 设定了最小样本量目标为≥10 条，上不封顶
- 采用了分页/滚动方式
- 避免仅靠前几条数据就下结论

**执行**：
1. 设定明确的样本量目标
2. 采用分页/滚动方式尽可能收集更多数据
3. 基于充足样本进行归纳，而非仅靠前几条

### 5. 信息核实机制

当页面信息不完整时，主动扩展检索范围。

**要求**：
- 关键信息齐全
- 在信息缺失时立即启动备选方案
- 避免沿用过时信息

**执行**：
1. 发现关键信息缺失时，立即启动备选方案
2. 对于时效性信息，必须获取最新版本
3. 不确定的信息标注"待核实"，禁止编造

## 多任务组合

- 信息采集 + 操作验证：先完成信息采集，再对目标内容执行点赞/收藏/评论等操作
- 前置检查 + 专项工作流：任何任务开始前必须先执行前置能力检查
- 异常处理 + 继续执行：发现异常时评估影响程度，选择跳过、降级或请求人工接管
- 跨白名单组合：若任务同时涉及多个白名单站点（例如"在小红书找选品 + 去淘宝加购"），按用户指令顺序依次进入对应子 Skill，不要在同一子 Skill 内部混用其它站点的规则

## 通用约束（白名单站点若另有更严格约束，以子 Skill 为准）

- 采集、总结、对比、归纳、分析类任务：
  - 搜索轮次：用户不指定关键词的情况下，最多 5 轮关键词搜索
  - 获取候选：先打开一篇文章快速扫读，不符合任务需求的信息需要舍弃，符合任务需求的信息需要全部阅读（若查看标题即可筛除，可以不必扫读）
  - 最终入选： 至少10条，上不封顶
- 操作类任务：
  - 操作前，先检查该操作是否处于已完成状态
  - 操作时，即时确认操作是否生效，若遇到错误或异常，即时汇报，不能假定任务完成
  - 操作后，刷新页面或查看列表确认
- 时效性任务：若用户无指定，主动获取最新、最有效的信息。优先搜索"最新"、"2024"、"2025"等时间限定词，或按时间排序筛选数据源
- 产物不可重复
  1. URL 去重：相同 URL 只保留一条
  2. 近似去重：内容相似度超过 90% 视为重复。特别地，对于图片，调用视觉能力判断两张图片是否相似
  3. 保留高质量版本：选择信息更完整的版本。特别地，对于图片，选择分辨率更高的版本

## 禁止使用场景

- 纯文本生成任务（无需访问网页）
- 代码开发任务
- 数据分析任务（已有结构化数据文件）
- 需要调用外部 API 获取数据的任务
- 需要登录第三方平台但无法提供凭证的任务

## 交付物要求

- 信息采集输出：若无指定，默认输出 markdown 格式的结构化报告（含摘要、主要结果、数据来源）
- 操作验证输出：明确说明操作是否成功，如失败需说明原因
- 异常处理输出：标注异常类型、影响程度、处理方式
- 白名单站点任务：优先遵守对应子 Skill 的交付物规范（例如微博模块的"双份文档交付"规则、小红书的"最终交付可直接保存为 .md"规则、淘宝的"加购清单 + 备选清单 + 待确认问题"三段式）

