知网页面操作
用当前环境提供的 Chrome、浏览器或 computer use 工具操作真实页面。 这份 Skill 记录知网的页面路径与操作经验,不绑定某一种工具 API。 先阅读宿主浏览器工具的使用说明,再使用其实际支持的点击、填入、标签页、 截图和下载能力。 Chrome 当前登录态与 cnki-mcp 的持久浏览器 Profile 可能不同, 不能因 Chrome 可用就判定 MCP 已登录,反之亦然。
从哪里进入
| 当前目标 | 页面路径 | 核验重点 |
|---|---|---|
| 简单关键词搜索 | 知网首页的搜索框 | 搜索框前的字段,默认可能为“主题” |
| 多字段表单 | 首页“高级检索” → “高级检索”页签 | 每行字段、AND/OR/NOT、精确或模糊选项 |
| TI/AU 检索式 | 高级检索页面 → “专业检索”页签 | 整条表达式放在大文本框内 |
| 文章摘要与题录 | 结果中的篇名链接 | 详情页标题、作者、来源是否匹配 |
| 某期目录 | 详情页刊名或年期链接,或首页“出版物检索” | 期刊名称、年份、期号和目录标题 |
| 引用格式 | 文章详情上方“引用”图标 | 弹层中的格式名称与题录 |
| 阅读或下载 | 文章详情的阅读与下载区 | 区分 HTML阅读、原版阅读、PDF下载、CAJ下载 |
高级检索入口当前可转到 https://kns.cnki.net/kns8s/AdvSearch。
入口变化时从首页当前链接进入,不遍历猜测地址。
文章的 v、期刊的 p 等动态参数应取自当前页面,不复制旧参数构造新链接。
可同时记录 DOI 和完整题录,便于动态链接失效时重新定位。
搜索与结果筛选
先确认所处页签。首页输入关键词;高级检索表单按行选择字段再填词; 专业检索输入完整表达式,三种输入方式不要混用。
在高级表单里,通过字段下拉选择篇名、作者、文献来源等。 用“+”增加条件,核对行间逻辑和“精确/模糊”选项。页面可有中英文扩展、 同义词扩展,保留或调整时应与用户的检索范围一致。
已知题名作者可在专业检索中输入以下实际验证过的表达式:
TI='因果推断经验研究中的中介效应与调节效应' and AU='江艇'其他字段与运算符阅读
cnki-searchskill 的references/search-syntax.md。网页高级表单可以表达同字段组合, 不代表 MCP 的结构化参数也接受这种写法。设置用户需要的时间范围后点击“检索”。新搜索使用“检索”, 只有需要进一步缩小已有结果时才用“结果中检索”。
结果可能仍在同一 URL 的下方。查看“共找到 … 条结果”,向下滚动到结果表, 等题名和作者文字加载完成再读取。提交前下方的“主编推荐”不算搜索结果。
按需选择“学术期刊”等文献类型、左侧“来源类别”的 CSSCI 等条件。 排序栏可见相关度、发表时间、被引、下载、综合;其中“下载”是排序项, 表格“操作”列中的“下载”才是操作入口。
记录检索词、过滤条件、排序、总条数和实际查看条数。需要更多结果时 使用页面可见的翻页控件,检查页码与题名确实改变,并去除重复记录。 不把前一页或前若干条当成全部文献。
进入详情和提取信息
点击篇名常会打开新标签,原页面内容不变不代表点击失败。 检查标签列表,选择新出现且题名匹配的详情页。不要连续点击制造重复标签。
从详情主区域按需读取篇名、作者、单位、期刊、年期、页码、摘要、关键词、 基金、DOI 与分类号。页面没有显示的字段记为未提供;有展开控件时再展开。 作者链接进入作者页,刊名或年期链接进入期刊导航,不能把它们当文章详情链接。
特别区分日期。实测文章在结果表显示 2022-06-11 10:55,
详情标明这是“在线公开时间”,正式题录为 2022 (05): 100-120。
不要据结果表时间把文章写成六月刊,也不要把在线公开时间直接当出版日期。
点击详情上方“引用”可打开弹层,实测显示 GB/T 格式引文、知网研学、 EndNote 和“更多引用格式”。按页面当前格式名称选择,不预设标准年份。 需要更多格式时再打开相应入口;只要求题录时读取文本即可。 弹层文字未出现在页面结构里时查看截图,不把空文本框当无引用数据。
“CNKI AI阅读”与侧边 AI 提问属于其他服务,不作为论文原文的证据。 HTML阅读和原版阅读是否可用取决于当前权限;看到目录或摘要不等于已经读过全文。
期刊与年期
详情上方的刊名和年期可打开期刊导航。从年期链接进入时,可能直接选中
对应年份和期号。需要另一年期时,在左侧“刊期浏览”中展开年份、点击
No.05 等期号,检查右侧标题变成目标“YYYY年XX期”后读取目录。
期刊页顶部的“出版来源检索”用于找期刊,下拉可选刊名、主办单位、ISSN、CN。 “本刊内检索”用于在当前期刊里找文章,两者不要混用。 较早年份可能在年份树的下一页;右侧目录含栏目标题、文章、书评、征稿等内容, 按用户要求区分研究论文和其他项目,不能把每个目录行都算成论文。
下载确认与执行
在首次点击文章“下载”“PDF下载”“CAJ下载”之前,向用户说明具体文献和 格式,并询问是否下载。示例:
已找到《因果推断经验研究中的中介效应与调节效应》(江艇,2022)。 页面提供 PDF 和 CAJ,是否下载 PDF?
没有本次明确答复就停在入口。多篇可统一列出范围后一次询问; 同一范围获得确认后不反复询问。SubAgent 无法询问时把问题交回主 Agent。
获准后按当前页面执行:
- 点击批准的格式;用户未指定格式时可在询问中建议 PDF。 只有 CAJ 时告知实际格式,不能改扩展名冒充 PDF。
- 检查是开始下载、打开阅读器,还是进入登录或收费页面。 看到下载按钮不代表已有下载权限。遇到付费、验证码或机构认证时 停在对应步骤,交由用户处理,不绕过限制。
- 在浏览器下载列表或宿主下载结果中确认完成、文件名与保存位置。 有文件访问能力时检查文件非空且确为相应格式,避免把登录页当论文。 部分下载、失败、取消或仅打开预览页都不算完成。
- 返回真实文件路径;工具只能看到完成状态却拿不到路径时如实说明, 不猜测用户的下载目录。不要覆盖同名已有文件。
本 Skill 只描述用户确认后的正常网页入口操作,不提供批量全文抓取脚本, 不向 cnki-mcp 添加全文下载能力。这里的下载流程尚未作实际文件下载验收, 本次探索只核对了入口,详见下方探索记录。
容易误判的页面状态
- 隐藏验证码:页面结构可能长期包含“拖动下方拼图完成验证”。 先看截图或可见性,只有可见验证弹层确实阻挡操作时才请用户处理。
- 机构与个人登录并存:页头可同时显示机构名和“个人登录”。 不据此直接判断机构权限失效,也不据机构名保证能下载每篇文章。
- 页面没跳转:检查新标签和页面下方,搜索可在原页更新,详情可新开标签。
- 文字暂时为空:等待加载并检查当前区域,避免立即报告无结果或反复提交。
- 操作目标失效:页面更新后重新读元素;坐标仅作当前截图的备用依据。
- 真实阻塞:说明当前页面和缺少的步骤,保留现场供用户处理。 不擅自使用邮箱、注册、付费或提交文献传递申请。
探索依据
可复现的访问路径、样例题录和已验证范围见 references/exploration-notes.md。 这是 2026-09-18 的页面观察,后续使用以当前可见页面为准。