Alibabacloud Aiops Skills
Alibabacloud Aiops Skills from aliyun/alibabacloud-aiops-skills.
Skills in this plugin
292- ▌ Alibabacloud Tech Solution Animation Creation Auto Deploy · aliyun bundleAlicloud Service Scenario-Based Skill. Use for auto-deploying the "Build AI Animation Story Creation App" solution. Automatically creates OSS Bucket, deploys FC application via Devs template, and stops at the experience page. Triggers: "AI动画创作", "animation creation", "动画故事部署", "deploy animation story app".
- ▌ Alibabacloud Analyticdb Spark Application Analysis Helper · aliyun bundleAnalyze and troubleshoot Alibaba Cloud AnalyticDB (ADB) Spark applications—execution monitoring, failure diagnosis, performance anomaly detection, and cross-application comparison. Use this Skill when users need to: 1. Check the execution status of AnalyticsDB Spark applications (running, succeeded, failed, etc.). 2. Analyze root causes of failed AnalyticsDB Spark applications (e.g., OOM, data skew, dependency errors, permission issues). 3. Identify Spark applications with abnormal execution duration by statistical analysis. 4. Compare similar Spark applications to pinpoint performance anomalies or detect SQL execution plan differences. Also applicable for "why did my Spark job fail", "which Spark app is running slow", "compare two Spark runs", etc.
- ▌ Alibabacloud Elasticsearch Instance Manage · aliyun bundleAlibaba Cloud Elasticsearch Instance & Config Management Skill. Use for managing the lifecycle of an Elasticsearch instance (create, query, list, restart, upgrade/downgrade, node info) and for managing instance-side config such as snapshot backup and analyzer dictionaries. Triggers: "elasticsearch", "ES instance", "elasticsearch instance", "create ES", "query ES instance", "restart ES", "ES node", "cluster node", "upgrade ES", "downgrade ES", "scale ES", "resize ES", "ES snapshot", "ES backup", "snapshot setting", "create snapshot", "ES dict", "IK dict", "hot dict", "synonyms dict", "aliws dict", "analyzer dictionary"
- ▌ Alibabacloud Elasticsearch Instance Diagnose · aliyun bundleAlibaba Cloud Elasticsearch instance diagnosis skill. Use for cluster health checks, troubleshooting, and performance analysis on Elasticsearch instances. Triggers (English): Elasticsearch diagnosis, ES instance issues, slow search, write failures, cluster Red/Yellow, unassigned shards, node disconnected, load imbalance, thread pool 429, JVM/OOM/circuit breaker, disk watermark / read-only index, instance activating / change stuck, service avalanche / all shards failed. 触发词(中文): ES诊断、阿里云ES、Elasticsearch诊断、ES集群/实例故障排查、ES健康检查、集群红灯/变红/黄灯/变黄、集群异常、分片未分配、主分片未分配、节点掉线/离线、负载不均衡、搜索/查询变慢、慢查询、写入失败/变慢/拒绝、线程池打满、HTTP 429、内存过高、OOM、断路器、磁盘满/水位、索引只读、实例激活中/activating、变更卡住/未完成、雪崩、服务不可用、all shards failed。
- ▌ Alibabacloud Analyticdb Postgresql AI Coaching Best Practice · aliyun bundleImplement AI Coaching best practices on AnalyticDB for PostgreSQL (ADBPG): Leverage Supabase projects (training data management) + ADBPG instances with vector optimization to build RAG-driven coaching systems that guide users through domain-specific workflows, decision-making, or skill development. Use when: User wants to create Supabase projects (spb-xxx), ADBPG instances (gp-xxx), vector knowledge bases, or RAG-driven coaching systems on ADBPG. Triggers: "Supabase", "ADBPG", "vector database", "knowledge base", "RAG", "AI coaching", "coaching system", "spb-xxx", "gp-xxx"
- ▌ Alibabacloud Elasticsearch Log Config Generator · aliyun bundleUse when the user needs to generate a log collection configuration file (OpenTelemetry Collector or Elastic Beats / Filebeat) that writes logs to Alibaba Cloud Elasticsearch or self-managed Elasticsearch. Covers file logs, log API ingestion (OTLP / HTTP webhook), and Kafka log topics. Also matches natural requests such as: write a filebeat.yml, generate an otelcol config, send logs to ES, collect nginx or Java application logs to Elasticsearch, or sync Kafka logs to ES. Always output one configuration file targeting Elasticsearch; never mix technology stacks or emit non-ES outputs.
- ▌ Get Bizdate · aliyun bundle获取真实系统日期 / 业务日期(bizdate)。 触发场景:任何需要“今天/昨天/当前日期”的场景,包括补数据填 start-biz-date / 即席查询传日期参数 / 任务参数模板 $bizdate / 授权 effective-end。 核心规则:bizdate = T-1(昨天);禁止使用会话上下文中的 system time(是快照不可信);必须用 date 命令实时获取。 平台差异:macOS 用 date -v-1d,Linux 用 date -d "-1 day"。 触发词:今天日期、昨天日期、当前日期、bizdate、业务日期、T-1、补数据日期、system time。
- ▌ Submit Batch Task · aliyun bundle提交离线计算任务(从开发区提交到运维区)。 触发场景:提交任务 / submit 离线任务 / 任务从 DEV 提交到生产 / submit-batch-task / 获取 SubmitId 和 NodeId。 关键点:TaskType × Engine 两级分支决定 Code 语言和 ParamList Key 规则(Python / Shell / Hive_SQL / MaxCompute_SQL 等)。 注意:不支持 --data-source-id 参数(数据源在 update-batch-task 阶段已保存)。 触发词:提交离线任务、submit-batch-task、任务提交、获取 SubmitId、获取 NodeId、DEV 提交到生产。
- ▌ Update Batch Task · aliyun bundle编辑/更新已存在的离线计算任务(代码、数据源、调度配置、上下游依赖)。触发场景:修改任务代码 / 更新任务调度 / 切换数据源 / 设置 cron 表达式 / 配置 CustomScheduleConfig / 调整上游依赖 / update-batch-task。关键点:TaskType 必填且不可改类型;FileId 不能从 list-nodes 直接获得,需通过 list-files 按任务名查找;大整数 DataSourceId 必须按字符串传参,否则报 NumberFormatException;DEV_PROD 项目里 update-batch-task 即使 --env DEV 也要用生产数据源 ID;分钟级调度分"每小时重置"与"全天连续"两种,后者 CronExpression 固定为 "0 0 0 * * ?" 并用 CustomScheduleConfig 表达间隔;Update 后若要生效到 PROD 仍需 submit + publish-object-list。触发词:修改任务代码、更新任务调度、切换数据源、update-batch-task、设置 cron、配置 CustomScheduleConfig、更新上游依赖、每5分钟调度。
- ▌ Create Standard · aliyun bundle创建数据标准(包括元数据监控 METADATA 和质量监控 QUALITY)。 触发场景:创建数据标准 / 新建质量规则 / 添加元数据监控 / create-standard / StandardMonitorConfigList。 监控类型 Type(METADATA / QUALITY)决定 StandardMonitorConfigList 子元素字段组合;QUALITY 需 RuleSubType / QualityRuleTemplate / RuleConfigList / RuleValidateConfigList。 触发词:创建数据标准、新建质量规则、元数据监控、create-standard、StandardMonitorConfigList、METADATA、QUALITY。
- ▌ Update Standard · aliyun bundle更新/编辑已有数据标准(含元数据监控 METADATA 和质量监控 QUALITY)。 触发场景:修改数据标准 / 更新质量规则 / 调整监控配置 / update-standard。 监控类型 Type(METADATA / QUALITY)决定 StandardMonitorConfigList 子元素字段组合,QUALITY 需 RuleSubType / QualityRuleTemplate 等。 StandardMonitorConfigList 子元素的 Id 决定新增/更新/删除。 触发词:修改数据标准、更新质量规则、调整监控配置、update-standard、StandardMonitorConfigList、METADATA、QUALITY。
- ▌ Create Project · aliyun bundle管理 Dataphin 项目创建场景的需求拆解、公开项目查询与创建 API 覆盖边界。 当用户要创建 Dataphin 项目、初始化 Basic 或 DevProd 项目、检查项目是否已存在、确认项目依赖、配置项目白名单或准备项目创建参数时进入。 触发词:创建项目、新建项目、Dataphin 项目、项目初始化、DevProd、Basic、项目白名单、项目依赖、create project、project initialization。 关键限制:当前 dataphin-public CLI 未暴露 create-project/update-project/delete-project;本 Skill 不伪造内部 REST,只能执行公开查询、依赖与白名单命令,并输出项目创建参数清单。
- ▌ Execute Ad Hoc Task · aliyun bundle执行 Dataphin 即席查询任务(临时跑 SQL / 脚本 / 查元信息,不创建持久化任务)。触发场景:执行 SQL / 即席查询 / 临时跑一段代码 / 建表 / 查数据源表 / execute-ad-hoc-task / DATABASE_SQL / MaxCompute_SQL / ad-hoc。关键点:OperatorType 为字符串枚举(MySQL/Oracle/PostgreSQL/SQLServer 统一用 DATABASE_SQL;MaxCompute 用 MaxCompute_SQL);DATABASE_SQL 必须同时传 --data-source-id 和 --data-source-schema;MaxCompute_SQL 只需 --project-id;参数名是 --code 不是 --script;get-ad-hoc-task-result 的 --sub-task-id 从 0 开始;结果可能延迟几秒才能取到;MaxCompute 结果格式为 [["_c0","_c1",...],[1,2,...]]。触发词:执行 SQL、即席查询、临时跑代码、建表、execute-ad-hoc-task、DATABASE_SQL、MaxCompute_SQL、ad-hoc、查表结构。
- ▌ Pause Task Instance · aliyun bundle暂停/恢复 Dataphin 调度任务实例(按任务名 + 业务日期 + 运行时点定位并触发 PAUSE/RESUME)。触发场景:实例暂停 / 暂停调度 / 恢复调度 / pause / resume / operate-instance PAUSE / 阻止实例被调度拉起 / 小时任务暂停某个时点。完整流程:list-instances(按 bizdate + DueTime 筛选)→ operate-instance(PAUSE/RESUME) → get-physical-instance 验证 SchedulePaused。关键点:bizdate 默认 T-1(今日运行的实例业务日期通常是昨天);小时任务一个 bizdate 有多个实例,需按 DueTime 选定时点;PAUSE 成功后实例 StatusList 可能仍为 WAIT_SCHEDULE,真正判据是 NodeInfo.SchedulePaused=true。触发词:暂停实例、pause、恢复实例、resume、operate-instance PAUSE、暂停调度、阻止调度。
- ▌ Rerun Task Instance · aliyun bundle重跑 Dataphin 调度任务实例,支持两种模式:①单实例/批量重跑(operate-instance RERUN);②重跑下游链路(fix-data,联动重跑根实例及所有下游)。触发场景:周期实例失败需要重跑 / rerun / 重跑实例 / operate-instance / fix-data / 重跑下游 / 修复链路数据 / 实例恢复 / 任务运维。模式①流程:list-projects → list-instances → operate-instance(RERUN) → get-physical-instance-log 验证。模式②流程:list-instances → fix-data(--root-instance-id) → get-physical-instance-log 验证 taskrun。关键点:实例必须属于指定的 project-id;bizdate 默认 T-1;fix-data 的 --root-instance-id 必须传 JSON 对象 {"Id":"t_xxx"};fix-data 不创建新实例而是创建新 taskrun,验证需查 taskrun 日志。触发词:重跑实例、rerun、任务重跑、operate-instance、fix-data、重跑下游、修复链路数据、实例恢复、补跑实例。
- ▌ Manage Biz Entity · aliyun bundle管理 Dataphin 业务实体(业务对象/业务活动)的查询、创建、更新、上线、下线、删除。 当用户要管理业务实体、业务对象、业务活动,或进行维度/事实/汇总逻辑建模前的业务模型配置时进入。 触发词:业务实体、业务对象、业务活动、biz entity、biz object、biz process、BIZ_OBJECT、BIZ_PROCESS、维度建模、事实建模。 关键限制:--type 决定 JSON 分支;BIZ_OBJECT 用 --biz-object,BIZ_PROCESS 用 --biz-process;JSON 字段必须使用 OpenAPI PascalCase;写操作需 HITL 确认。
- ▌ Query Kg · aliyun bundle知识图谱图数据查询。通过 CLI 原生命令完成:Cypher 图查询(仅 Neo4j 引擎)、邻居节点遍历与关键词/语义混合搜索(引擎无关)。纯查询 Skill,不含任何写操作。查询前必须先确认图谱空间绑定的图引擎(Neo4j / Lindorm)——Lindorm 不支持 Cypher。 触发场景:知识图谱查询 / Cypher 查询 / 邻居遍历 / 图查询 / 关系路径查询 / 语义搜索 / 知识图谱探索。
- ▌ Find Tenant Root Node · aliyun bundle查找租户的虚拟根节点(virtual_root_node_xxx)。 触发场景:创建任务时需要指定上游依赖为"根节点" / 遇到 NodeWithoutUpstream 报错 / 新任务 UpStreamList 为空需要挂默认上游 / 需要获取项目 DagId。 方法:读任意已有任务的 TaskInfo.DagId → 去掉 d_ 前缀 → 拼出 virtual_root_node_数字。 注意:后缀不是 project_id 也不是 tenant_id,是项目 DagId 的数字部分。 触发词:根节点、虚拟根节点、virtual_root_node、上游依赖、NodeWithoutUpstream、UpStreamList 为空、DagId、默认上游。
- ▌ Monitor Task Instance · aliyun bundle监控 Dataphin 调度任务实例的运行状态、获取执行日志、排查未运行或失败原因。触发场景:查看实例状态 / 查日志 / 任务没跑 / 实例 WAIT_SCHEDULE / 实例 FAILED / 任务运行失败 / 排查未运行原因 / 获取 taskrun 日志。流程:list-instances 定位实例 → get-physical-instance 查看详情 → get-physical-instance-log 获取日志。关键点:bizdate 默认 T-1;list-instances 返回字段在 .PageResult.Data[].NodeInfo.Name 和 .StatusList;多时点调度的同一业务日期会有多个实例;WAIT_SCHEDULE 且 DueTime 未到、BlockType/WaitReason 为空属正常;SchedulePaused=true 表示节点被暂停。触发词:实例状态、查看日志、任务没跑、WAIT_SCHEDULE、FAILED、任务监控、实例监控、taskrun、运行日志、排查实例。
- ▌ Manage Lookup Table · aliyun bundle管理 Dataphin 数据标准码表(Lookup Table)的完整生命周期:创建、查询、更新、删除,码值列表整体覆盖式维护。 触发场景:创建码表 / 新建标准代码 / 维护码值 / 更新码表 / 删除码表 / 查看码表详情 / lookup table。 流程:get-standard-lookup-table 查询 → create-standard-lookup-table 创建 → update-standard-lookup-table 更新 → delete-standard-lookup-table 删除。 关键点:码值元素为 JSON {Value,Name,EnglishName,Description},Value/Name 必填且 ≤64 字符、Value 码表内唯一;码表名称目录内唯一、编码租户内唯一;无 list 型命令,查询按码表 ID 走 get;写操作需 HITL 确认。 触发词:码表、标准代码、码值、代码值、lookup table、create-standard-lookup-table、LookupTableValueList。
- ▌ Manage Topic Domain · aliyun bundle管理 Dataphin 主题域(Data Domain)的完整生命周期:查询、创建、更新、删除,用于组织数据仓库的业务分层架构。 主题域挂在「数据板块(业务单元 BizUnit)」之下,创建/更新/删除必须先确定所属 --biz-unit-id。 触发场景:管理主题域 / 新建主题域 / 修改主题域 / 删除主题域 / 查询主题域列表 / 组织数据仓库分层 / 数据板块下建主题域 / 配置上级主题域(层级)。 流程:list-data-domains/get-data-domain-info 查询 → create-data-domain 创建 → update-data-domain 修订 → delete-data-domain 删除。 关键点:主题域无发布流程,创建即生效;biz-unit-id 为硬前置依赖;大整数 ID 用字符串传参;写操作需 HITL 确认。 触发词:主题域、数据域、data domain、topic domain、data-domain、数据板块、业务单元、biz-unit、数据仓库分层、主题域列表、上级主题域。
- ▌ Query Asset Details · aliyun bundle综合查询资产的完整画像:批量读取资产自定义属性值(GetAssetAttributes),并查询单个资产的目录挂载层级链与专题/目录描述(GetCatalogAssetDetails 增强)。纯只读,不含任何写操作。 当用户场景涉及 资产画像查询、资产属性值查询、目录层级、资产挂在哪个专题、目录路径、资产上下文 时进入。 触发场景:一次性拿一批资产(GUID)的自定义属性值;查某资产挂在哪个专题/目录、完整层级路径;属性写入后回读校验。 触发词:资产画像、资产属性查询、get-asset-attributes、目录层级、DirectoryChain、专题、get-catalog-asset-details、资产详情、资产挂载目录。 关键限制:GetAssetAttributes 单次 GuidList ≤ 50;不传 AttributeCodeList 返回全部属性;GUID 不存在不报错且不返回;DirectoryChain 按 Level 升序、末节点为叶子;19 位 ID 必须字符串。
- ▌ Create Node Supplement · aliyun bundle对 Dataphin 调度节点发起补数据(按业务日期回填历史数据)。触发场景:补数据 / 补跑 / 回填数据 / backfill / supplement / create-node-supplement / dagrun 状态跟踪。流程:list-nodes(必须传 --node-sub-biz-type-list)→ create-node-supplement → 海量模式经 get-operation-submit-status 取 ExternalBizId → get-supplement-dagrun → get-supplement-dagrun-instance。关键点:bizdate 默认 T-1;--env 必须匹配 HasDev/HasProd;--node-id-list 传单个 JSON 对象字符串 {"Id":"n_xxx"};create-node-supplement 返回的 SubmitId 是 jobId,真正 SupplementId 是 ExternalBizId;小时任务用 --min-due-time/--max-due-time。触发词:补数据、补跑、回填数据、重跑任务、backfill、supplement、create-node-supplement、dagrun。
- ▌ Manage Data Standard · aliyun bundle管理 Dataphin 数据标准的完整生命周期:创建、更新、发布、下线、删除、查询,支持元数据监控(METADATA)与数据质量监控(QUALITY)。 触发场景:管理数据标准 / 新建标准 / 修改标准 / 发布标准 / 下线标准 / 删除标准 / 查询标准列表 / 质量规则 / 元数据监控。 流程:list-standards/get-standard 查询 → create-standard 创建 → publish-standard 发布 → update-standard 修订 → offline/delete-standard 下线删除。 关键点:19 位大整数 ID 用字符串传参;monitor-config 的 Type(METADATA/QUALITY)决定字段组合;写操作需 HITL 确认。 触发词:数据标准、管理标准、发布标准、下线标准、删除标准、标准列表、质量规则、元数据监控、data standard、METADATA、QUALITY。
- ▌ Create Data Source · aliyun bundle新建 Dataphin 数据源(87 种类型)。 触发场景:创建数据源 / 新建数据源 / 添加数据源 / 注册数据源 / create-data-source / ConfigItemList 怎么填 / JDBC URL 格式 / DEV-PROD 数据源分离。 Type 决定 ConfigItemList 内 Key/Value 的组合完全不同(MySQL / MaxCompute / DORIS / POSTGRE_SQL / CLICKHOUSE / HANA 等)。 DEV_PROD 项目需先建 PROD 数据源再建 DEV 并关联 ProdDataSourceId(大整数必须字符串传递)。 触发词:创建数据源、新建数据源、添加数据源、create-data-source、ConfigItemList、JDBC、DEV PROD 数据源、ProdDataSourceId、数据源类型。
- ▌ Manage Tenant Member · aliyun bundle管理 Dataphin 租户成员,包括添加成员、移除成员、查询可添加用户、查询租户成员列表、配置全局角色。触发场景:添加租户成员 / 移除租户成员 / 租户角色配置 / 批量加人 / tenant member / 租户管理员。流程:list-addable-users 定位用户 → add-tenant-members 添加 → list-tenant-members 验证;更新角色用 update-tenant-member;移除用 remove-tenant-member。关键点:add-tenant-members 的 --user-list 必须传单个 JSON 对象字符串 {"Id":"xxx"},不能传数组;仅 SuperAdmin / 系统管理员可调用;全局角色包括 SYSTEM_ADMIN / DATASOURCE_MANAGER / SECURITY_ADMIN / QUALITY_MANAGER / EXPORT_ADMIN / DATA_STANDARD_MANAGER / LABELS_BUSINESS_MEMBER / DATAPRO_OPERATE_ADMIN 等(完整枚举以 list-addable-roles 实际返回的 Code 字段为准)。触发词:租户成员、添加租户成员、移除租户成员、租户角色、tenant member、tenant administration。
- ▌ Configure Quality Rule · aliyun bundle通过 Dataphin OpenAPI 完成数据质量规则的全生命周期管理:创建监控对象、配置质量规则、设置调度与告警、试跑验证、启停规则、查看执行结果。 当用户场景涉及为某张表/字段配置质量校验、设置质量调度或告警、试跑质量规则、查看质量结果时进入。 触发场景: - 「给 X 表 Y 字段配非空/唯一/值域/枚举校验」 - 「质量规则要不要试跑 / 质量试跑失败排查」 - 「质量规则挂调度 / 质量告警通知负责人」 触发词:质量监控、质量规则、数据质量校验、质量告警、质量试跑、质量调度、监控对象、validateCondition、upsert-quality-rule。 关键限制 / 类型分支:监控对象类型必须先确认;监控对象名称不可让用户填写;templateId 必须用 list-quality-templates 实测获取;模板级 formProperties 必填项以界面和模板定义为准;validateCondition 无后端默认必须显式传;分区表试跑必须钉单分区;归档模式/计分方式/质量分权重 OpenAPI 不可配。
- ▌ Create Pipeline Task · aliyun bundle通过 CLI 创建集成管道任务(数据同步/数据搬运/ETL pipeline)。 触发场景:创建数据集成任务 / 数据同步任务 / 管道任务 / pipeline / 数据搬运 / reader-writer 配置 / MySQL→MaxCompute / Doris→PostgreSQL / 离线集成 / create-pipeline / update-pipeline / create-pipeline-node。 覆盖两条路径:两步法(create-pipeline-node 建草稿 → update-pipeline 填配置提交) 和 一步法(create-pipeline)。 关键坑:PluginConfig 必须是 JSON 字符串;columnMappings 顺序敏感且必填;空 PluginConfig 触发 ClassCastException。 触发词:创建管道任务、数据同步、数据集成、数据搬运、pipeline、create-pipeline、update-pipeline、reader writer、PluginConfig、MySQL→MaxCompute、Doris→PostgreSQL。
- ▌ Update Pipeline Task · aliyun bundle修改已存在的集成管道任务配置(调度 / 通道 / 组件 / 基本信息),采用「先查后改、全量回写」模式。 触发场景:修改管道任务调度周期 / cron / 重跑策略 / 优先级 / 上游依赖 / 资源组;修改并发数、脏数据上限、超时;修改 reader-writer 字段映射 / 过滤条件 / 分区表达式;修改后重新提交。 触发词:修改管道任务、更新管道、修改调度配置、改 cron、修改同步任务、update-pipeline、修改并发、修改脏数据、修改字段映射、重新提交管道。 关键限制:update-pipeline 是全量覆盖而非增量 patch——node-info / pipeline-config / schedule-config 均必填,必须先 get-pipeline-by-id 回读再改;19 位大整数 ID 字符串传参。
- ▌ Manage Asset Attributes · aliyun bundle查询资产类型下可用的自定义属性定义,并按 GUID 批量覆盖写资产属性值(数据开发工作流回写资产画像的典型场景)。 当用户场景涉及 资产自定义属性、属性回写、批量更新属性、资产打标、工作流回写画像 时进入。 触发场景:查某类资产(TABLE/COLUMN)有哪些可填属性;把加工/治理结果批量写回资产属性(覆盖写,支持清空);任务结束后回写负责人/密级/上架说明等。 触发词:资产属性、自定义属性、属性回写、批量更新属性、update-asset-attributes、get-asset-type-attribute-codes、AssetAttribute、资产打标。 关键限制:InputMode(CUSTOM_INPUT/DROPDOWN_SINGLE/DROPDOWN_MULTI/HYPERLINK)决定 Values 校验;写入为覆盖(Upsert)语义,Values=[] 表示清空;单次批量 ≤ 50 条;19 位 ID 必须字符串。
- ▌ Manage Standard Mapping · aliyun bundle管理 Dataphin「字段-数据标准」落标映射关系:按资产/标准双向查询映射、批量创建有效/无效映射、置为无效映射、删除有效/无效映射。 触发场景:落标 / 字段关联标准 / 标准映射 / 解除映射 / 查字段映射了哪些标准 / 查标准落到哪些字段。 流程:get-asset-mapping-relations / get-belong-asset-mapping 查现状 → create-standard-mapping 建映射 → update-standard-mapping-to-invalid 置无效 → delete-standard-valid-mapping / delete-standard-invalid-mapping 删除。 关键点:仅「已生效」标准可建有效映射;关系已在无效映射列表时由 invalid-mapping-relation-operation-type 决定转有效或跳过;GUID 列表单次上限 1000;写操作需 HITL 确认。 触发词:落标、标准映射、映射关系、有效映射、无效映射、create-standard-mapping、get-asset-mapping-relations、落标监控。
- ▌ Manage Project Member · aliyun bundle管理 Dataphin 项目成员(添加 / 移除 / 更新角色 / 查询列表)。 当用户场景涉及项目成员变更、角色分配、权限调整时进入。 触发场景: - 需要给项目添加开发者或运维人员 - 需要调整成员角色(如从访客改为开发者) - 需要批量移除项目成员 - 查询项目当前成员列表 触发词:项目成员、添加成员、移除成员、更新角色、成员管理、add-project-member、remove-project-member、update-project-member。 关键限制:角色码为整数枚举(1-5);DEV_PROD 模式项目需指定 Env(DEV/PROD);19 位 ID 必须字符串呈现。
- ▌ Update Compute Source · aliyun bundle编辑/更新已存在的计算源配置。 触发场景:修改计算源配置 / 更新计算源密码 / 调整计算源参数 / update-compute-source。 UpdateCommand 需要 Id,Type + ConfigList 的 Key 规则与 create-maxcompute-compute-source 完全相同。 触发词:修改计算源、更新计算源、编辑计算源、update-compute-source。
- ▌ Get Batch Task Info By Name · aliyun bundle仅知道离线任务名称时,获取任务完整详情(含代码、调度、上游、FileId、NodeId、DagId)。 触发场景:知道任务名但不知道 FileId / 想查看任务代码和调度配置 / 想获取任务的 NodeId 或 DagId / 想查任务上下游关系。 方法:list-files 按 Name 反查 FileId → get-batch-task-info 拿详情。 注意:不要用 ops list-nodes --search-text(入参严格且常报 InternalError)。 触发词:按任务名查询、查看任务代码、查看任务调度、获取 FileId、获取 NodeId、list-files、get-batch-task-info、任务详情。
- ▌ Manage Column Permission · aliyun bundle管理 Dataphin 列级/字段级资源权限的授权、回收、查询、操作日志和权限点校验。 当用户要控制敏感字段可见性,给手机号、身份证号、薪资等字段授予或回收 SELECT 权限,查询某张表/某个字段当前授权记录,或验证某个用户是否拥有字段权限时进入。 触发词:列级权限、字段权限、字段级权限、column permission、field permission、敏感字段可见性、授权字段、回收字段权限、PHYSICAL_FIELD、LOGICAL_FIELD。 关键限制:公共 OpenAPI 通过资源点授权/回收,不提供内部 grantByResource 形态;字段授权前必须先定位字段资源标识;--resource-list 元素需传 JSON 对象(如 '{"ResourceId":"field_guid"}');写操作需 HITL 确认。
- ▌ Manage Data Masking · aliyun bundle管理 Dataphin 数据脱敏规则配置的需求拆解、前置分类分级检查和公开 API 覆盖边界。 当用户要给手机号、身份证号、邮箱、姓名等敏感字段配置掩码、加密、哈希、保留首尾、白名单绕过或验证查询脱敏效果时进入。 触发词:数据脱敏、脱敏规则、动态脱敏、字段脱敏、手机号打星、身份证脱敏、邮箱脱敏、白名单、desensitize、masking、mask、FPE、MD5、NO_MASK。 关键限制:当前 dataphin-public CLI 和版本感知 OpenAPI 索引未暴露脱敏规则 CRUD;本 Skill 不伪造内部 REST 为外部命令,只执行公开分类分级前置检查并输出可交付参数清单。
- ▌ Manage Kg Schema · aliyun bundle知识图谱本体模型(Schema)管理。通过 CLI 原生命令完成:整体 Schema 的导出(YAML)、导入(YAML)、发布到图引擎并查询发布结果。实体类型/关系类型/属性的增删改通过编辑 Schema YAML 后整体导入实现,不提供细粒度的单类型 CRUD 接口。 触发场景:知识图谱 Schema / 本体模型 / 实体类型 / 关系类型 / Schema 导入导出 / Schema 发布。
- ▌ Create Dataset · aliyun bundle创建 Dataphin 非结构化数据集(含全生命周期管理):设计确认 → list-datasets 查重 → create-dataset 创建 → get-dataset 回读验证; 另覆盖 update-dataset 更新、delete-dataset 删除(高危)。 当用户场景涉及数据集(Dataset)的创建 / 查询 / 复用 / 更新 / 删除,或为非结构化工作流准备输入输出载体时进入。 触发词:创建数据集、新建数据集、数据集管理、元数据表、表结构设计、向量表、Milvus 数据集、 create-dataset、list-datasets、get-dataset、update-dataset、delete-dataset、Dataset。 关键限制:Scenario/Type/StorageType/MetadataStorageType/ContentType 五字段创建后不可变;同项目数据集名唯一; Milvus 必须主键+向量字段齐备;delete-dataset 无回收站且不自查下游引用;写操作前必须 HITL 确认。
- ▌ Call Data Service API · aliyun bundle调用 Dataphin 数据服务已发布的 API。使用附带脚本(Python 标准库,零依赖)完成 HMAC-SHA256 签名,无需下载官方 SDK。 触发场景:调用数据服务 API / SDK 调用 / Python 调用 / AppKey 调用 / 异步调用 API。
- ▌ Create And Publish API · aliyun bundle数据服务 API 创建与发布的完整流程。数据开发工程师通过 CLI 完成:查询项目 → 创建 SQL 模式 API → 发布到生产环境 → 验证发布结果。 触发场景:创建数据服务 API / 发布 API / SQL API / API 开发 / 直连数据源创建 API。
- ▌ Monitor API Operations · aliyun bundle数据服务 API 运维监控。查看 API 调用汇总、趋势分析、调用日志明细和异常影响分析,支持日常运维和问题排查。 触发场景:API 监控 / 调用日志 / 运维分析 / 异常分析 / 调用趋势 / 调用统计。
- ▌ Manage Row Level Permission · aliyun bundle管理 Dataphin 行级权限的查询、创建、更新、删除、按表查询、按用户查询和授权账号查询。 当用户要按字段值控制表数据行可见范围,维护行级权限规则、管控列、关联表、规则授权账号,或排查某张表/某个用户拥有哪些行级权限时进入。 触发词:行级权限、行权限、row permission、row-level permission、按行过滤、管控规则、规则授权账号、受影响账号、数据行可见范围。 关键限制:create 返回 true 不返回 ID,需 list 反查;复杂数组参数每个元素传 JSON 对象字符串;update 需完整回填 mappingColumns/rules/tables;写操作需 HITL 确认。
- ▌ Manage App And Bindauth · aliyun bundle数据服务应用管理与 API 权限绑定。创建应用 → 添加成员 → 为应用授权 API → 验证授权结果 → 获取 AppKey/AppSecret 供后续调用使用。 触发场景:创建数据服务应用 / API 授权 / 权限绑定 / 应用管理 / 密钥管理。
- ▌ Manage Kg Knowledge · aliyun bundle知识图谱知识数据管理与查询。通过 CLI 原生命令完成:实体与关系的增删改查、批量写入、Cypher 图查询、邻居节点遍历。 触发场景:知识图谱数据 / 创建实体 / 创建关系 / 批量导入 / Cypher 查询 / 邻居遍历 / 知识数据管理。
- ▌ Create Maxcompute Data Source · aliyun bundle创建 MaxCompute 类型数据源并验证连通性——将 MaxCompute 项目接入 Dataphin 作为数据源。 支持 Basic 和 DEV-PROD 两种项目模式。 触发场景: - 新接入 MaxCompute 数据仓库到 Dataphin - 为 Dataphin 项目配置 MaxCompute 数据源 - 验证 MaxCompute 数据源连通性 触发词:创建 MaxCompute 数据源、接入 MaxCompute、新建 MC 数据源、MaxCompute datasource、配置 MaxCompute。 关键限制:Type 固定 MAX_COMPUTE;DEV-PROD 项目需分两步创建(先生产后开发);19 位 ID 必须字符串传参。
- ▌ Check Data Source Connectivity · aliyun bundle校验数据源连通性(不会实际创建数据源,仅测试连接)。 触发场景:测试数据源连接 / 检查数据源是否可达 / 创建数据源前先验证连通性 / 数据源连接失败排查 / check-data-source-connectivity。 CheckCommand 中 Type 决定 ConfigItemList 内 Key/Value 的组合,与 create-data-source 同构。 触发词:测试数据源连接、检查连通性、数据源连接失败、check-data-source-connectivity、验证数据源。
- ▌ Update Dataset Schema · aliyun bundle更新 Dataphin 非结构化数据集的元数据表结构(加列/改列)。核心约束:**表结构不能在线编辑**—— 正确流程是「即席查询执行 ALTER SQL 改库表 → update-dataset 重新提交表结构 → 回读验证」三段式。 当用户场景涉及数据集表结构变更(加字段/加向量列/改注释)、"数据集表结构怎么改"、"重新加载表结构"时进入。 触发词:更新数据集表结构、数据集加列、修改元数据表、加字段、重新加载表结构、ALTER TABLE 数据集、 update-dataset-schema、表结构变更。 关键限制:表结构无在线编辑入口,必须 SQL + 重新提交两步走;Milvus 不支持 DDL(仅 PG/Lindorm 适用); 已有工作流引用的列禁止删改(只加不减最安全);写操作前必须 HITL 确认。
- ▌ Grant Data Source Permission · aliyun bundle给项目生产账号(PRODUCE)授权数据源 SYNC_READ/SYNC_WRITE,是发布到生产的前置条件。 触发场景:发布失败报 DsRead/DsWrite / DATA_SOURCE_AUTH_NO_PERMISSION / 给生产账号授权 / 数据源权限不足 / PublishStatus=0 且 ErrorMessage 含权限报错 / grant-resource-permission / 发布生效校验。 完整流程:get-project-produce-user → grant-resource-permission → publish-object-list → list-publish-records(PublishStatus=1) → list-nodes --env PROD(HasProd=true)。 关键限制:effective-end 必须 yyyy-MM-dd HH:mm:ss 字符串;DATASOURCE.RUN 不能授给 PRODUCE 账号(OpenAPI 限制)。 触发词:发布失败、DsRead、DsWrite、DATA_SOURCE_AUTH_NO_PERMISSION、数据源授权、生产账号授权、grant-resource-permission、PublishStatus=0、发布生效校验、PRODUCE 账号。
- ▌ Check Compute Source Connectivity · aliyun bundle校验计算源连通性(不会实际创建,仅测试连接)。 触发场景:测试计算源连接 / 检查计算源是否可达 / 创建计算源前先验证 / check-compute-source-connectivity。 CheckCommand.Type 决定 ConfigList 内 Key/Value 的组合,与 create-maxcompute-compute-source 同构。 触发词:测试计算源连接、检查计算源连通性、check-compute-source-connectivity、验证计算源。
- ▌ Create Unstructured Workflow · aliyun bundle从一句业务需求(如"PPT 按页构建解决方案知识库")出发,端到端创建 Dataphin 非结构化工作流: 需求分析 → 算子链路设计 → 数据集设计与创建 → 工作流 JSON 组装 → create-work-flow-by-json 创建 → 输出验证指引。 当用户场景涉及非结构化数据处理(文档解析 / 图片理解 / 音视频处理 / 知识库构建 / 向量化入库)或数据集增删改查时进入。 触发词:非结构化工作流、创建工作流、知识库构建、文档解析、向量化、create-work-flow-by-json、unstructured workflow。 关键限制:**仅支持离线(OFFLINE)**——实时工作流(TaskType=5/REALTIME 数据集)不在范围,Step 1 预检到即告知;仅 BASIC 项目(Env=PROD);数据集 5 字段建后不可变;LLM/评分/去重算子不吃 URL 需桥接;环境值必须回读禁止编造;写操作前 HITL 确认。
- ▌ Update Unstructured Workflow · aliyun bundle更新指定的 Dataphin 非结构化工作流:get-pipeline-by-id 回读现有配置 → 局部修改算子/连线/提示词/模型参数 → update-pipeline 提交(PipelineType=14)→ 回读验证。 当用户场景涉及修改已存在的非结构化工作流(调整提示词 / 换模型 / 增删算子 / 调整连线 / 切换数据集版本 / 改资源规格 / 改调度)时进入。 触发词:更新工作流、修改工作流、update-pipeline、调整算子、改提示词、换模型、加一个算子、 删除算子、修改非结构化工作流、update unstructured workflow。 关键限制:必须先 get-pipeline-by-id 回读、在回读结果上就地修改,禁止凭记忆重建整个 JSON; update-pipeline 是全量覆盖式更新(提交什么就变成什么);已有 step 的 UUID/stepId 不可改; 写操作前必须 HITL 确认。
- ▌ Create Maxcompute Compute Source · aliyun bundle创建 MaxCompute 类型计算源——将 MaxCompute 项目接入 Dataphin 作为数据开发任务的计算底座。 计算源是项目运行离线任务的引擎,必须先建计算源才能在项目上绑定。 触发场景: - 为 Dataphin 项目准备 MaxCompute 计算资源(dev / prod) - 新建 MaxCompute 计算引擎 / 绑定 MaxCompute 项目 - 创建计算源前先做连通性预检 触发词:创建计算源、新建计算源、添加计算引擎、MaxCompute 计算源、create-compute-source、ConfigList 怎么填。 关键限制:Type 固定 MAX_COMPUTE(大写下划线,非驼峰);同一 MaxCompute project 只能绑定一个计算源且无解绑 API;19 位 ID 字符串传参。