Antigravity Skills 用户手册
文档版本: v2.1.0 技能总数: 50 个
本文档详细介绍了当前工作区中所有可用的 Skill (技能)。这些 Skill 提供了从文档处理、艺术创作到全栈开发和测试的广泛能力。
您可以通过 @[skill-name] 或 /skill-name 在对话中调用这些技能。
目录
- Algorithmic Art (算法艺术)
- Brand Guidelines (品牌指南)
- Canvas Design (平面设计)
- Doc Co-authoring (文档共创)
- DOCX (Word 文档处理)
- Frontend Design (前端设计)
- Internal Comms (内部沟通)
- NotebookLM (知识库问答)
- MCP Builder (MCP 服务构建)
- PDF (PDF 处理)
- PPTX (演示文稿)
- Skill Creator (技能创建)
- Slack GIF Creator (Slack 动图制作)
- Theme Factory (主题工厂)
- Web Artifacts Builder (Web 应用构建)
- Webapp Testing (Web 应用测试)
- XLSX (Excel 表格处理)
- UI/UX Pro Max (UI/UX 设计智能)
- JSON Canvas (Canvas 创作)
- Obsidian Markdown (Obsidian 语法)
- Obsidian Bases (Obsidian 数据库)
- Brainstorming (头脑风暴)
- Dispatching Parallel Agents (并行分发)
- Executing Plans (执行计划)
- Finishing a Development Branch (分支收尾)
- Receiving Code Review (接收审查)
- Requesting Code Review (请求审查)
- Subagent Driven Development (子Agent开发)
- Systematic Debugging (系统化调试)
- Test Driven Development (测试驱动开发)
- Using Git Worktrees (Git工作树)
- Using Superpowers (使用超能力)
- Verification Before Completion (完成前验证)
- Writing Plans (编写计划)
- Writing Skills (编写技能)
- Planning with Files (文件任务规划)
- BDI Mental States (BDI 认知模型)
- Memory Systems (记忆系统)
- Filesystem Context (文件系统上下文)
- Context Fundamentals (上下文基础)
- Context Optimization (上下文优化)
- Context Compression (上下文压缩)
- Context Degradation (上下文退化)
- Multi-Agent Patterns (多 Agent 模式)
- Hosted Agents (托管 Agent)
- Tool Design (工具设计)
- Project Development (项目开发)
- Evaluation (基础评估)
- Advanced Evaluation (高级评估)
- Remotion (视频创作)
1. Algorithmic Art (算法艺术)
调用方式: @[algorithmic-art] 或 /algorithmic-art
简介: 专注于基于代码的生成艺术创作。它使用 p5.js 库,通过受控随机性和数学算法创造独特的视觉体验,而非简单复制现有艺术。
核心能力:
- 创作算法哲学: 定义独特的生成艺术美学理念(如"有机湍流"、"量子谐波")。
- 生成交互式艺术: 创建包含参数控制、种子导航的 HTML 构件,支持实时探索和变体生成。
- 专业级工艺: 强调精细的调整、色彩和谐及算法的深度。
使用案例:
用户: "请为一个科技会议创作一个名为'数字脉冲'的生成艺术背景,要求体现数据的流动和连接。"
Skill 响应:
- 创建 "Digital Pulse" 算法哲学文档,定义视觉规则(粒子流、网络连接、霓虹色彩)。
- 生成交互式 HTML 作品,包含"流动速度"、"连接密度"等可调参数。
2. Brand Guidelines (品牌指南)
调用方式: @[brand-guidelines] 或 /brand-guidelines
简介: 提供 Anthropic 官方品牌视觉识别指南,用于确保生成的文档、演示文稿或设计符合品牌标准。
核心能力:
- 色彩规范: 提供官方配色板(深色背景 #141413,强调色 #d97757 等)。
- 字体规范: 指导使用 Poppins (标题) 和 Lora (正文) 字体。
- 样式应用: 将品牌元素应用于各类 Artifact。
使用案例:
用户: "帮我美化这个幻灯片,使用 Anthropic 的品牌风格。"
Skill 响应: 应用官方配色方案(Warm Dark 或 Light 模式),调整字体为 Poppins/Lora,并规范图表颜色。
3. Canvas Design (平面设计)
调用方式: @[canvas-design] 或 /canvas-design
简介: 用于创作高质量的静态视觉设计(海报、艺术图、封面)。强调极简主义、排版设计和视觉哲学。
核心能力:
- 设计哲学创作: 定义视觉语言(如"野兽派喜悦"、"几何静默")。
- 画布创作: 生成 PDF 或 PNG 格式的高精度设计作品。
- 字体管理: 支持加载自定义字体以提升排版质感。
使用案例:
用户: "设计一张关于'未来城市'的极简主义海报。"
Skill 响应:
- 构思"Concrete Future"设计哲学(强调负空间、粗野主义线条)。
- 生成包含建筑几何图形和精细排版的海报 PDF。
4. Doc Co-authoring (文档共创)
调用方式: @[doc-coauthoring] 或 /doc-coauthoring
简介: 通过结构化的引导流程,协助用户编写高质量文档(如 PRD、设计文档、提案)。
核心能力:
- 上下文收集: 通过针对性提问挖掘用户意图和背景信息。
- 结构化起草: 分章节进行头脑风暴、筛选和撰写。
- 读者视角测试: 模拟读者视角审阅文档,发现盲点。
使用案例:
用户: "我要写一份新功能的 PRD。"
Skill 响应:
- 引导用户回答关于目标用户、核心功能、约束条件的问题。
- 建议 PRD 结构(背景、目标、方案、指标)。
- 逐章协助撰写并完善内容。
5. DOCX (Word 文档处理)
调用方式: @[docx] 或 /docx
简介: 处理 Word 文档的创建、编辑和分析。支持复杂的修订模式(Track Changes)和底层 XML 编辑。
核心能力:
- 文档读取: 提取文本以进行分析。
- 红线修订 (Redlining): 规划并批量实施修订(Track Changes),适合合同或论文修改。
- OOXML 编辑: 直接操作底层 XML 以处理复杂格式。
- 新文档创建: 使用从头构建文档。
使用案例:
用户: "帮我审阅这份合同
contract.docx,将所有的'30天'期限改为'60天',并开启修订模式。"Skill 响应:
- 读取文档并定位所有"30天"。
- 使用底层脚本批量替换文本并标记插入和删除标签。
- 生成带有修订记录的新文档。
6. Frontend Design (前端设计)
调用方式: @[frontend-design] 或 /frontend-design
简介: 构建具有独特美感和生产级质量的前端界面。避免通用的 AI 审美,追求独特的视觉风格。
核心能力:
- 美学设计: 选择独特的主题(如"复古未来主义"、"杂志排版风")。
- 代码实现: 生成 React/HTML/CSS 代码,包含细腻的动画和交互。
- 视觉差异化: 使用非标准字体、独特的布局和配色。
使用案例:
用户: "做一个展示新咖啡品牌的落地页。"
Skill 响应: 设计一个以深棕色和奶油色为主调,配合衬线字体和视差滚动效果的页面,体现高端手工质感。
7. Internal Comms (内部沟通)
调用方式: @[internal-comms] 或 /internal-comms
简介: 撰写符合企业标准的内部沟通稿件,如周报、公告、FAQ 等。
核心能力:
- 模板套用: 包含 3P (Progress, Plans, Problems)、Newsletter 等标准格式。
- 风格适配: 确保语气专业、清晰且符合公司文化。
使用案例:
用户: "写一份关于下周系统维护的内部通知。"
Skill 响应: 使用标准公告模板,包含时间、影响范围、行动建议和联系方式,语气正式且体贴。
8. NotebookLM (知识库问答)
调用方式: @[notebooklm] 或 /notebooklm
简介: 直接查询 Google NotebookLM 笔记本,获取基于文档的确切答案。有效减少幻觉。
核心能力:
- 知识检索: 从用户上传的文档源(PDF, 文本等)中提取精准信息。
- 引用溯源: 提供答案对应的原文引用链接。
使用案例:
用户: "根据我们的 RAG 技术白皮书,解释一下检索重排序的策略。"
Skill 响应:
- 连接到 NotebookLM 中的相关笔记本。
- 输入查询并获取包含引用的回答。
9. MCP Builder (MCP 服务构建)
调用方式: @[mcp-builder] 或 /mcp-builder
简介: 指导用户构建 Model Context Protocol (MCP) 服务器,使 LLM 能够连接外部数据或工具。
核心能力:
- 架构规划: 确定资源 (Resources)、工具 (Tools) 和提示词 (Prompts)。
- 代码脚手架: 提供实现指导。
- 测试与评估: 生成测试用例以验证 MCP 服务。
使用案例:
用户: "我想做一个能查天气数据的 MCP server。"
Skill 响应:
- 规划
get_weather工具的输入输出 Schema。- 提供完整代码实现。
10. PDF (PDF 处理)
调用方式: @[pdf] 或 /pdf
简介: 全方位的 PDF 处理工具箱,支持读取、生成、合并、拆分和表单填充。
核心能力:
- 内容提取: 提取文本、表格(保留布局)。
- 文件操作: 合并、拆分、旋转页面。
- 生成 PDF: 从代码生成复杂 PDF。
使用案例:
用户: "把这三份报告合并成一份,并给每页加个水印。"
Skill 响应:
- 合并文件。
- 创建水印页面并叠加到每一页上。
- 输出最终文件。
11. PPTX (演示文稿)
调用方式: @[pptx] 或 /pptx
简介: 创建和编辑 PowerPoint 演示文稿。支持从大纲生成、模板应用和底层修改。
核心能力:
- HTML 转 PPTX: 将 HTML/CSS 设计转换为原生 PPTX 幻灯片。
- 模板填充: 基于现有 PPTX 模板替换文本和图片。
使用案例:
用户: "基于这个 Markdown 大纲生成一份 10 页的演示文稿。"
Skill 响应:
- 规划每页内容和配图。
- 渲染每一页的布局并生成最终文件。
12. Skill Creator (技能创建)
调用方式: @[skill-creator] 或 /skill-creator
简介: 指导用户创建高质量的 Antigravity Skill。
核心能力:
- 结构初始化: 创建标准的目录结构。
- 最佳实践: 提供 Workflow 编写指南。
使用案例:
用户: "我想创建一个自动分析财报的 Skill。"
Skill 响应: 协助创建 skill 目录并编写核心定义。
13. Slack GIF Creator (Slack 动图制作)
调用方式: @[slack-gif-creator] 或 /slack-gif-creator
简介: 制作针对 Slack 优化的动画表情包(GIF)。
核心能力:
- 参数优化: 控制 128x128 尺寸、帧率和色彩数。
- 动画工具: 绘制自定义动画(抖动、旋转、爆炸效果)。
使用案例:
用户: "做一个'派对鹦鹉'风格的点头动画 GIF。"
Skill 响应: 绘制逐帧动画并应用优化参数导出。
14. Theme Factory (主题工厂)
调用方式: @[theme-factory] 或 /theme-factory
简介: 为 Artifacts(如 PPT、文档、网页)应用预设的专业设计主题。
核心能力:
- 主题库: 提供 10+ 种预设主题。
- 主题生成: 根据描述生成新的配色和字体组合。
使用案例:
用户: "把这个 PPT 换成'赛博朋克'风格。"
Skill 响应: 生成包含霓虹色和暗色背景的主题配置并应用。
15. Web Artifacts Builder (Web 应用构建)
调用方式: @[web-artifacts-builder] 或 /web-artifacts-builder
简介: 构建复杂的、多文件的 React Web 应用,支持 Tailwind CSS 和 shadcn/ui。
核心能力:
- 项目脚手架: 初始化完整项目。
- 单文件打包: 将整个应用打包为单个 HTML 文件,方便分享和预览。
使用案例:
用户: "做一个带有仪表盘和数据可视化的交互式报表应用。"
Skill 响应: 搭建界面并集成图表,打包为 HTML 交付。
16. Webapp Testing (Web 应用测试)
调用方式: @[webapp-testing] 或 /webapp-testing
简介: 使用 Playwright 对本地 Web 应用进行自动化测试和调试。
核心能力:
- 自动化测试: 模拟用户操作(点击、输入)。
- 状态验证: 截图、检查 DOM 元素。
使用案例:
用户: "测试一下我的登录页面,确认输错密码会报错。"
Skill 响应: 编写测试脚本模拟流程并验证。
17. XLSX (Excel 表格处理)
调用方式: @[xlsx] 或 /xlsx
简介: 专业的 Excel 表格处理,支持复杂公式、格式保留和财务模型构建。
核心能力:
- 数据分析: 进行数据清洗和统计。
- 公式重算: 确保公式结果准确更新。
使用案例:
用户: "帮我做一个 DCF 估值模型,包含 5 年预测和敏感性分析。"
Skill 响应: 构建带有链接公式和投行标准格式的模型。
18. UI/UX Pro Max (UI/UX 设计智能)
调用方式: @[ui-ux-pro-max] 或 /ui-ux-pro-max
简介: 一个强大的 UI/UX 设计智能数据库和搜索引擎。
核心能力:
- 风格搜索: 检索特定风格的详细特征和实现参数。
- 资产推荐: 提供配色、字体和图表建议。
使用案例:
用户: "我要为一款医疗 App 设计一个干净、专业的仪表盘。"
Skill 响应: 提供针对医疗行业的配色和布局建议,并给出 Tailwind 参数。
19. JSON Canvas (Canvas 创作)
调用方式: @[json-canvas] 或 /json-canvas
简介:
专门用于创建和编辑 JSON Canvas 文件 (.canvas),常用于 Obsidian 的可视化白板。
核心能力:
- 画布构建: 生成包含文本、文件、链接和分组的复杂节点网络。
- 可视化规划: 支持通过边连接节点,定义方向和颜色。
使用案例:
用户: "帮我在 Obsidian 里画一个关于'微服务架构'的思维导图。"
Skill 响应: 创建
.canvas文件并定义各组件节点之间的逻辑连接。
20. Obsidian Markdown (Obsidian 语法)
调用方式: @[obsidian-markdown] 或 /obsidian-markdown
简介: 深度支持 Obsidian 增强版 Markdown 语法的创作和编辑,包括双向链接、块引用、Callouts 等。
核心能力:
- 双向链接: 正确处理引用及其变体。
- 增强组件: 生成美观的 Callouts 和图表。
使用案例:
用户: "写一篇关于 Python 并发编程的技术笔记,包含警告提示,并链接到我的'异步 IO'笔记。"
Skill 响应: 生成包含警告 Callout 且指向双链文档的笔记。
21. Obsidian Bases (Obsidian 数据库)
调用方式: @[obsidian-bases] 或 /obsidian-bases
简介:
用于处理 Obsidian Bases (.base) 文件,实现类似数据库的动态视图。
核心能力:
- 视图定义: 创建多种展示视图。
- 动态过滤: 编写基于 SQL 风格或 YAML 语法的复杂过滤器。
使用案例:
用户: "帮我建议一个任务管理数据库,显示未完成任务并计算剩余日期。"
Skill 响应: 创建带有对应过滤器和公式定义的
.base文件。
22. Brainstorming (头脑风暴)
调用方式: @[brainstorming] 或 /brainstorming
简介: 在进行任何创造性工作之前使用的 Skill。通过对话澄清用户意图、需求和设计约束。
核心能力:
- 需求澄清: 通过提问挖掘隐含需求。
- 方案探索: 提出不同实现方案供选择。
使用案例:
用户: "我想给我的 Todo 应用加个 AI 功能。"
Skill 响应: 询问具体场景并提出集成方案供参考。
23. Dispatching Parallel Agents (并行分发)
调用方式: @[dispatching-parallel-agents] 或 /dispatching-parallel-agents
简介: 当面临多个相互独立的任务时,并行分发 Agent 处理。
使用案例:
用户: "同时为后端的 Python 和前端的 React 编写 Dockerfile。"
Skill 响应: 分别启动 Agent 环境并行处理。
24. Executing Plans (执行计划)
调用方式: @[executing-plans] 或 /executing-plans
简介: 用于执行已制定的实施计划,按步骤引导执行并设置检查点。
使用案例:
用户: "开始执行刚才制定的 重构数据库层 计划。"
Skill 响应: 读取计划并按步骤实施修改,确认后继续下一步。
25. Finishing a Development Branch (分支收尾)
调用方式: @[finishing-a-development-branch] 或 /finishing-a-development-branch
简介: 功能开发完成后引导用户进行分支收尾(合并、PR、清理)。
使用案例:
用户: "功能开发完了,准备合并。"
Skill 响应: 检查更改,推荐合并策略并生成 PR 描述。
26. Receiving Code Review (接收审查)
调用方式: @[receiving-code-review] 或 /receiving-code-review
简介: 辅助用户评估和处理收到的代码审查反馈。
使用案例:
用户: "同事 review 说这个函数太长,但拆分会破坏上下文。"
Skill 响应: 进行分析并建议合理的处理回复。
27. Requesting Code Review (请求审查)
调用方式: @[requesting-code-review] 或 /requesting-code-review
简介: 在提交代码前进行质量自查和 PR 描述生成。
使用案例:
用户: "我要提交代码了,帮我做最后检查。"
Skill 响应: 运行验证套件并汇总变更生成请求。
28. Subagent Driven Development (子Agent开发)
调用方式: @[subagent-driven-development] 或 /subagent-driven-development
简介: 将复杂计划拆分为独立子任务由子 Agent 执行。
使用案例:
用户: "去查一下 Table 组件最新的 API 变更。"
Skill 响应: 启动子 Agent 进行查阅并将结果返回主会话。
29. Systematic Debugging (系统化调试)
调用方式: @[systematic-debugging] 或 /systematic-debugging
简介: 系统的调试方法论,包括根因分析、假设验证和修复实施。
使用案例:
用户: "API 偶尔报 502 错误。"
Skill 响应: 引导用户收集证据、提出针对性假设并验证修复。
30. Test Driven Development (测试驱动开发)
调用方式: @[test-driven-development] 或 /test-driven-development
简介: 遵循 TDD 开发模式:编写失败测试 -> 实现代码 -> 重构。
使用案例:
用户: "写一个解析这种特殊日期格式的函数。"
Skill 响应: 先创建案例脚本验证预期,逐步补全代码逻辑。
31. Using Git Worktrees (Git工作树)
调用方式: @[using-git-worktrees] 或 /using-git-worktrees
简介: 创建隔离的 Git 工作树进行并行开发而不干扰当前工作区。
使用案例:
用户: "正在开发时线上有个急 Bug 要修。"
Skill 响应: 开启 Worktree 进行修复并快速切回原任务。
32. Using Superpowers (使用超能力)
调用方式: @[using-superpowers] 或 /using-superpowers
简介: Meta-Skill。用于帮助用户发现当前可用的 Skill 及其用法。
使用案例:
用户: "我想做一个 PPT,用什么工具好?"
Skill 响应: 推荐适用的技能组合并说明用法。
33. Verification Before Completion (完成前验证)
调用方式: @[verification-before-completion] 或 /verification-before-completion
简介: 在任务完成前的最终验证阶段,确保提供实质性成功证据。
使用案例:
用户: "我觉得这个 Bug 修好了。"
Skill 响应: 运行全套测试套件确保无回归后确认。
34. Writing Plans (编写计划)
调用方式: @[writing-plans] 或 /writing-plans
简介: 在编码前编写详细的实施规格说明。
使用案例:
用户: "我们要把数据库从 SQLite 迁移到 MySQL。"
Skill 响应: 创建计划文档规划迁移、脚本和验证步骤。
35. Writing Skills (编写技能)
调用方式: @[writing-skills] 或 /writing-skills
简介: 辅助编写新技能或修改现有技能的规则及工作流。
使用案例:
用户: "我想写一个用来自动优化 SQL 的技能。"
Skill 响应: 规划技能结构并辅助编写定义文件。
36. Planning with Files (文件任务规划)
调用方式: @[planning-with-files] 或 /planning-with-files
简介: 实现基于文件的持久化任务规划模式,规避上下文窗口限制。
核心能力:
- 进度追踪: 维护进展详情文件。
- 长效记忆: 记录发现和关键决策。
使用案例:
用户: "研究一下把 Django 项目迁移到 FastAPI。"
Skill 响应: 初始化规划套件文件记录调研细节。
37. BDI Mental States (BDI 认知模型)
调用方式: @[bdi-mental-states] 或 /bdi-mental-states
简介: 模拟信念、愿望、意图模型进行复杂推理决策。
核心能力:
- 信念建模: 构建结构化信念。
- 意图生成: 形成具体行动指令。
使用案例:
用户: "模拟购买电动车时的理性买家心理。"
Skill 响应: 实时更新和演变心理状态进行模拟推导。
38. Memory Systems (记忆系统)
调用方式: @[memory-systems] 或 /memory-systems
简介: 为 Agent 构建持久化的长期记忆系统,实现跨会话存储。
核心能力:
- 实体追踪: 持续追踪项目关键状态。
- 信息持久化: 确保存储跨会话可用。
使用案例:
用户: "记得我之前说过的项目偏好吗?"
Skill 响应: 检索历史配置库并应用于当前任务。
39. Filesystem Context (文件系统上下文)
调用方式: @[filesystem-context] 或 /filesystem-context
简介: 利用文件系统作为扩展的缓冲区应对超长信息。
核心能力:
- 上下文卸载: 自动写入不常用的信息。
- 按需加载: 需要细节时重新检索。
使用案例:
用户: "分析这 50 个长文档。"
Skill 响应: 执行文件摘要存储策略以节省窗口空间。
40. Context Fundamentals (上下文基础)
调用方式: @[context-fundamentals] 或 /context-fundamentals
简介: 分析和解释 LLM 的上下文窗口及注意力机制。
核心能力:
- 窗口监控: 分析窗口利用率。
- Prompt 诊断: 指出导致指令丢失的原因。
使用案例:
用户: "模型老忽略我中间的指令。"
Skill 响应: 提供位置优化建议提升模型关注度。
41. Context Optimization (上下文优化)
调用方式: @[context-optimization] 或 /context-optimization
简介: 优化 Token 消耗,通过缓存友好的结构和分区提高效率。
核心能力:
- 预算管理: 设定 Token 清理策略。
- 任务分区: 将长任务切分。
使用案例:
用户: "对话太长 API 调用变慢了。"
Skill 响应: 识别冗余数据块并启动清理方案。
42. Context Compression (上下文压缩)
调用方式: @[context-compression] 或 /context-compression
简介: 对超长文本进行高质量压缩,保留核心事实。
核心能力:
- 摘要提取: 递归提取关键信息对。
- 语义再造: 重塑紧凑内容。
使用案例:
用户: "总结 10 万字论文的核心论点。"
Skill 响应: 生成高密度摘要替代原文。
43. Context Degradation (上下文退化)
调用方式: @[context-degradation] 或 /context-degradation
简介: 专门检测和处理长会话中的任务表现下降。
核心能力:
- 退化诊断: 自动检测幻觉倾向。
- 会话刷新: 引导用户安全重启。
使用案例:
用户: "Agent 最近变得有点笨了。"
Skill 响应: 执行状态快照总结并重启纯净会话。
44. Multi-Agent Patterns (多 Agent 模式)
调用方式: @[multi-agent-patterns] 或 /multi-agent-patterns
简介: 设计和协调多 Agent 协作系统(Supervisor/Swarm 等)。
核心能力:
- 工作流组织: 定义角色的分工逻辑。
- 交接协议: 标准化任务交接。
使用案例:
用户: "设计一个包含 PM、Dev、QA 的团队流。"
Skill 响应: 规划任务分发机制和闭环验证流。
45. Hosted Agents (托管 Agent)
调用方式: @[hosted-agents] 或 /hosted-agents
简介: 构建和部署长期运行在后台的独立 Agent 服务。
核心能力:
- 容器部署: 提供 Docker 等环境方案。
- 定时任务: 实现无会话持续监控。
使用案例:
用户: "需要监控 GitHub 的回复机器人。"
Skill 响应: 编写逻辑并打包部署至远程服务器执行。
46. Tool Design (工具设计)
调用方式: @[tool-design] 或 /tool-design
简介: Agent 工具接口及 MCP 服务的专业设计指南。
核心能力:
- Schema 定义: 编写清晰无歧义的接口。
- 鲁棒设计: 确保障碍处理能力。
使用案例:
用户: "给 Agent 加数据库查询功能。"
Skill 响应: 给出语义化接口设计及其对应的 Schema。
47. Project Development (项目开发)
调用方式: @[project-development] 或 /project-development
简介: LLM 原生应用系统的全周期开发与架构指导。
核心能力:
- 可行性评估: 判断任务匹配度。
- 选型与调研: 模型、框架评估。
使用案例:
用户: "我想做一个法律合同审查系统。"
Skill 响应: 按照咨询式步骤辅助规划方案并启动 PoC。
48. Evaluation (基础评估)
调用方式: @[evaluation] 或 /evaluation
简介: 为 Agent 系统建立起基于数据集和指标的反馈循环。
核心能力:
- 测试集构建: 构建可靠的黄金数据集。
- 自动化流: 完成批量化评估。
使用案例:
用户: "怎么知道修改 Prompt 有没有用?"
Skill 响应: 运行对比测试脚本产出分值报告。
49. Advanced Evaluation (高级评估)
调用方式: @[advanced-evaluation] 或 /advanced-evaluation
简介: 涉及 LLM-as-a-Judge、成对偏好等高级量化分析。
核心能力:
- 自动评估: 使用更高阶模型打分。
- 偏见分析: 多维度的输出质量检测。
使用案例:
用户: "评估营销文案生成的创意和相关度。"
Skill 响应: 设置评测模型进行反馈点评与数据分析。
50. Remotion (视频创作)
调用方式: @[remotion] 或 /remotion
简介: Remotion 最佳实践 - 使用 React 创建视频。
核心能力:
- 视频合成: 使用 React 组件创建视频。
- 动画模式: 提供排版、转场和 3D 内容的动画方案。
使用案例:
用户: "制作一个 15 秒的动态排版宣传视频。"
Skill 响应: 生成 React 代码,使用 Remotion 渲染视频。