cold-start-interview:研究画像冷启动访谈
目的
科研工作台的所有 skill 都依赖 CLAUDE.md 中的研究画像(默认数据源、默认引用格式、算力环境、合规红线等)。画像为空时,下游 skill 只能猜测默认值,这与 guardrail 第 2 条(不做静默补充)直接冲突。本技能通过一次简短访谈把画像填上,是整套工作台的入口。
本技能同时是画像完整度的守门人:任何 skill 发现画像仍有 [填空] 时,都应引导用户回到本技能。
前置检查
- 确认插件根目录的
CLAUDE.md存在且包含"研究画像"一节。若文件缺失,先停止并报告——不要自己重建 CLAUDE.md。 - 读取画像当前状态,统计七个必填小节(研究领域与方向、常用数据源、算力环境、写作语言与目标期刊、引用格式、团队协作、伦理合规)中有多少仍是
[填空]。 - 若全部小节已填写且用户未指定
--redo,告知用户"画像已完整",建议改用customize做局部修改,除非用户坚持重谈。 - 检查是否存在未完成的访谈(画像中存在
[PENDING]标记,见下文"中断与续谈")。存在时优先询问用户是否续谈。
模式
参数由 argument-hint 传入,缺省时按规则自动选择:
| 模式 | 触发方式 | 行为 |
|---|---|---|
| quick | quick |
只问 5 个核心问题,约 2 分钟,其余小节保留 [填空] 并标注"quick 模式未覆盖" |
| full | full |
完整 15 问,覆盖全部七个小节 |
| --redo | --redo |
把现有画像各小节重置为 [填空] 后重新访谈(先向用户确认,因为这会丢弃已有画像内容) |
| --check | --check |
不提问,只输出画像完整度报告:哪些小节已填、哪些仍缺、哪些超过一年未复核 |
| (缺省) | 无参数 | 画像全空时默认 quick;画像部分已填时默认只补问缺失小节 |
1 · 开场说明
开始提问前,用一段话向用户说明三件事:
- 访谈的目的是填写 CLAUDE.md 中的研究画像,它决定后续所有 skill 的默认行为。
- 回答可以是口语化的,助手会负责整理成散文写入画像;任何问题都可以回答"跳过",对应小节保留
[填空]。 - 随时可以中断,中断处会标记
[PENDING],下次说"继续访谈"即可续谈。
然后展示本次模式要问的问题清单(quick 展示 5 问,full 展示 15 问),让用户心里有数。
2 · 提问清单(对应 CLAUDE.md 各占位)
以下 15 问与画像七个小节一一对应。quick 模式只问标记 ★ 的 5 问。
研究领域与方向
- ★ "请用一两句话描述你的研究领域和正在做的课题,越具体越好。"(追问:有没有想长期追踪的关键词?中英文都给我几个。)
- "有没有明确不做的方向或方法?比如不做动物实验、不做某类材料。"
常用数据源
- ★ "你平时查文献主要用哪些数据库?比如 OpenAlex、PubMed、CNKI、Web of Science。"(追问:有没有没权限或很少用的?)
- "文献管理用什么工具?Zotero、EndNote 还是 NoteExpress?有没有共享群组?"
算力环境
- ★ "你的计算任务在哪里跑?本机、课题组服务器、学校超算还是云?"(追问:远程的话怎么提交任务,有 Slurm 之类的调度系统吗?)
- "常用的软件环境是什么?Python 版本、conda、领域软件,单任务大概多大规模?"
写作语言与目标期刊
- ★ "论文和报告主要用中文还是英文写?"
- "常投的目标期刊或会议有哪些?说两三个就行。学位论文有学校模板要求吗?"
引用格式
- ★ "参考文献默认用什么格式?GB/T 7714、APA 还是 Vancouver?不同场景用不同格式的话分别说说。"
团队协作
- "有固定的课题组协作吗?文献库、代码仓库放在哪,谁负责终审?"
- "汇报节奏是怎样的?组会频率、周报要求之类的。"
伦理与数据合规
- "研究涉及人体、患者数据或动物实验吗?有伦理批件的话编号和有效期是什么?"
- "有没有数据不能离开某台机器、不能上传境外服务这类红线?基金项目有数据管理计划要求吗?"
收尾确认
- "有没有以上没问到、但你希望助手一直记住的偏好?比如写作风格、图的风格、单位习惯。"
- "我接下来会把回答整理成画像写回 CLAUDE.md,写之前会给你看一遍草稿,可以吗?"
3 · 整理回答
- 把每个问题的回答整理成对应小节的散文。不要写 YAML,画像是散文——分节用
###标题,内容是连贯的自然段。 - 保留用户原话中的关键细节(数据库权限、批件编号、软件版本),只做语句通顺化,不做信息增删。
- 用户回答"不知道"或"跳过"的小节,保留
[填空]并在其后括注"(访谈时已询问,用户暂未提供)",便于--check区分"没问过"和"问了没答"。 - 用户的口语表述出现明显矛盾时(如先说"只用英文写作"后说"学位论文按学校中文模板"),当面指出并请用户澄清,不要自行调和。
- 删除 CLAUDE.md 模板中各小节的"填写指引(访谈完成后删除本段)"段落——填写完成的画像不再保留指引文字。
4 · 草稿确认与写回
- 把整理好的画像草稿完整展示给用户,逐小节问"这一节这样可以吗?"。
- 用户提出修改后当场更新草稿,直到用户明确说"可以写入"。
- 用编辑工具把草稿写回 CLAUDE.md 的画像部分,只改动画像部分——guardrails、术语表、附录一律不动。
- 写回后按
provenance-record登记本次修改(paths 为 CLAUDE.md,note 写明"画像访谈写回,模式 <quick|full>")。
5 · 中断与续谈
- 用户中断("先到这""待会继续"或直接结束会话)时:已确认的小节正常写回;尚未问到的小节在 CLAUDE.md 对应位置标注
[PENDING: 访谈中断于第 N 问,续谈请运行 cold-start-interview]。 - 续谈时:读取画像,跳过已填写小节,从
[PENDING]标记处继续提问;全部问完后清除所有[PENDING]标记。 --check报告中[PENDING]小节单列为一类"访谈中断未完成",优先建议续谈。
输出模板
访谈完成后向用户输出:
## 画像访谈完成
- 模式:<quick|full|--redo|续谈>
- 已填写小节:x/7(列出小节名)
- 仍为 [填空] 的小节:(列出,或写"无")
- 写入位置:CLAUDE.md「研究画像」一节
- 运行记录:已登记 .openscience/provenance.jsonl
下一步建议:运行 research-lifecycle 开始你的第一个研究流程,
或运行 research-workspace 初始化工作区目录。
--check 模式的输出模板:
## 画像完整度报告
- 已填写:x/7 小节
- 空白([填空]):…
- 中断未完成([PENDING]):…
- 最后复核日期:…(超过一年时给出"建议运行 customize 重新确认"提示)
6 · quick 模式对话示例
以下是一段 quick 模式访谈的示意对话,供把握节奏与语气(内容为虚构示例):
助手:接下来 5 个问题,大概两分钟。回答可以口语化,任何问题都能说"跳过"。 第 1 问:请用一两句话描述你的研究领域和正在做的课题。 用户:我做植物抗病基因的,主要是水稻抗稻瘟病的分子标记辅助育种。 助手:第 2 问:平时查文献主要用哪些数据库?有没有没权限的? 用户:PubMed 和知网,Web of Science 学校没买。 助手:第 3 问:计算任务在哪里跑? 用户:基本就是办公室电脑,偶尔用课题组的服务器跑 BLAST。 助手:第 4 问:参考文献默认什么格式? 用户:中文 GB/T 7714,投英文刊的时候按期刊要求。 助手:第 5 问:论文主要用什么语言写? 用户:中文为主,毕业前想冲一篇英文。 助手:收到。我把这五条整理成画像草稿给你过目,其余两节(团队协作、伦理合规)先保留 [填空],之后可以运行 full 模式补全。
本技能不做什么
- 不替用户编造画像内容:用户没答的小节保留
[填空],绝不根据"研究者的典型情况"自行填充(guardrail 第 2、3 条)。 - 不修改 CLAUDE.md 中画像以外的任何内容:guardrails 的修改走
customize。 - 不做研究选题建议:访谈只收集画像信息,"我这个方向值不值得做"之类问题转交 research-lifecycle 的 question 阶段。
- 不验证用户提供信息的真实性(例如不真的去 SSH 登录用户的超算账号);画像信息按
[用户提供]对待。 - 不删除画像历史:--redo 会重置画像,但修改记录留在 provenance.jsonl 中可追溯。
收尾与下一步
- 画像填写完成后,提醒用户两个入口:
research-lifecycle(开始六阶段研究流程)和research-workspace(初始化工作区)。 - quick 模式结束后额外提醒:"本次只覆盖了 5 个核心问题,其余小节仍是 [填空],有空时可以运行
cold-start-interview full补全。" - 告知用户画像的更新通道:"以后信息变了,直接说'改一下画像'(走 customize)或重新访谈(cold-start-interview --redo)。"