# Research Lit

> 논문 검색, 선행연구 조사, 레퍼런스 찾기, 인용 확인, 문헌 리뷰, 이 주제 논문 있는지 확인, 참고문헌 정리 요청에 사용합니다. '이 주제 논문 찾아줘', '선행연구 뭐 있어?', '레퍼런스 좀 모아줘', '이 인용 실제로 있는 논문이야?', '문헌 리뷰 해줘' 같은 요청에 대응합니다. 단, 일반 웹·시장 자료 조사는 /research, 이미 모은 출처의 등급 판정은 /verify를 사용합니다.

- Skill: `fivetaku/research-lit` (Agent Skill)
- Install (CLI): `npx skillmds@latest add fivetaku/research-lit`
- Raw SKILL.md: https://api.skillmd.com/api/skills/fivetaku/research-lit/raw
- Safety review: pending
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: Research & Search
- Author: fivetaku (https://skillmd.com/u/fivetaku)
- Updated: 2026-09-17
- Page: https://skillmd.com/skills/fivetaku/research-lit

---


# lit Workflow

Codex-compatible mirror of `lit.md` from the `research` archetype.

# /lit — 논문 리서치와 레퍼런스

학술 문헌을 찾고, **실재하는지 확인하고**, 근거 강도까지 매겨 정리한다.

> 설계 근거: LLM은 문헌 **검색(발견)에서 재현율 13%**로 있는 논문의 68~96%를 놓치지만, **스크리닝(거르기)에서는 민감도 0.92~0.93**으로 사람에 준한다. 그래서 이 커맨드는 **찾기를 사람·DB에 맡기고 거르기·정리를 에이전트에 맡기는 순서**로 짜여 있다.
> 그리고 조작된 인용은 2023년 논문 2,828편당 1편에서 2026년 **277편당 1편**으로 늘었다. 실재 확인이 선택이 아니다.

## 사용법

```text
/lit {주제}              # 주제로 선행연구 탐색
/lit --check {인용문자열} # 이 인용이 실재하는지만 확인
/lit --seminal {분야}    # 그 분야의 기초 논문 계보
```

## 실행 흐름

### Step 1: 질문을 검색 가능한 형태로

- 무엇을 알고 싶은지 **한 문장**으로 적는다. 이게 안 되면 검색이 산으로 간다.
- 동의어·표기 변형을 나열한다 (한/영, 축약형, 옛 명칭).
- **제외 조건**도 적는다 — 어떤 게 나오면 관련 없는 것인지.
- `10-questions/`에 저장한다.

### Step 2: 찾기 — DB 우선, 에이전트는 보조

무료 공개 API를 먼저 쓴다. 인증 없이 열린다.

| 소스 | 용도 | 비고 |
|------|------|------|
| **Crossref** (`api.crossref.org/works?query=`) | DOI·서지·인용수 | 메타데이터 광범위 |
| **OpenAlex** (`api.openalex.org/works?search=`) | 인용 네트워크·주제 분류·오픈액세스 여부 | 무료, 키 불필요 |
| **PubMed E-utilities** | 생의학 | 초록까지 |
| **arXiv API** | preprint | **D급 기본** — 피어리뷰 아님 |
| **Semantic Scholar** | 인용 맥락·영향력 | rate limit 주의 |

- 검색 쿼리에 **연도를 붙인다** (`... 2025`, `after:2024`). 최신성 편향을 의도적으로 건다.
- 결과를 **버리지 말고 전부** `20-raw/`에 저장한다. 거르기는 다음 단계다.
- 접근 실패는 **URL과 실패 코드를 기록**한다. 조용히 빠뜨리지 않는다.

### Step 3: 거르기 — 여기서 에이전트를 쓴다

- Step 1의 질문과 제외 조건으로 **포함/제외를 판정**하고 사유를 한 줄씩 남긴다.
- 제외한 것도 목록에 남긴다. 나중에 "왜 이 논문이 없냐"는 질문에 답할 수 있어야 한다.
- **제외한 자료는 이후 요약·집계에 절대 들어가지 않는다** (`frameworks/output-correctness.md` §1).

### Step 4: 실재 확인 ★ (건너뛰지 않는다)

포함된 항목마다 확인한다.

- **DOI가 실제로 해석되는가** — Crossref/doi.org로 조회. 안 되면 그 인용은 쓰지 않는다.
- **저자·연도·저널이 메타데이터와 일치하는가** — 하나라도 어긋나면 원문을 다시 본다.
- **철회(retracted)되지 않았는가** — Crossref의 `update-to`/Retraction Watch 표시 확인. 철회 논문은 **명시적으로 표시**하고 인용하지 않는다.
- **preprint인가 게재본인가** — arXiv/bioRxiv 판만 있으면 D급이고, 저널 게재 여부를 확인해 등급을 올린다.

> 확인 못 한 항목은 **"확인 불가"로 남긴다.** 추측으로 채우면 그 뒤 전부가 오염된다.

### Step 5: 등급과 근거 강도

`50-sources/source_grades.md` 기준으로 A~E를 매기고, 주장별로 이렇게 가른다.

| 상태 | 조건 | 본문 사용 |
|------|------|----------|
| **verified** | 독립 출처 2개 이상, 충돌 없음, 1차 소스 도달 | 단정 가능 |
| **unresolved** | 출처 1개거나 충돌 미해소 | **단정 금지** — 별도 섹션 |
| **refuted** | 신뢰할 만한 반박 존재 | 반박과 함께만 언급 |

핵심 수치·인과 주장에는 **반증 검색 1회**를 붙인다. 반박이 나오면 refuted로 보낸다.

### Step 6: 정리와 기록

- `50-sources/_registry.md`에 등재: 식별자·서지·등급·확인일·접근 경로.
- 외부 API를 썼으면 **`third_party` 메타데이터**를 남긴다 (서비스명·이용약관/프라이버시 URL·확인일). 링크 부패도 관리 대상이다.
- 최종 정리는 `40-reports/`에.

## 산출물

```
10-questions/{주제}-lit-question.md      질문·동의어·제외조건
20-raw/{주제}/                            검색 원본(전량)
50-sources/_registry.md                   등재(식별자·등급·확인일)
40-reports/{주제}-lit-review.md           본문 + Unresolved/Refuted + 미확인 푸터
```

## 품질 게이트

- [ ] 검색은 DB로, 거르기는 에이전트로 — 순서가 지켜졌다
- [ ] 제외한 자료도 사유와 함께 목록에 남았다
- [ ] **모든 인용의 DOI/식별자가 실제로 해석됐다** (안 되면 미사용)
- [ ] 철회 논문 확인을 했다
- [ ] preprint와 게재본이 등급에서 구분됐다
- [ ] verified가 아닌 주장이 본문에 단정형으로 없다
- [ ] 접근 실패 URL이 전수 기록됐다
- [ ] 문서 끝에 `미확인:` 한 줄이 있다

## 참조

- 판정 기준: `frameworks/verification-rubric.md` (§4 조작된 참고문헌 — 식별자가 아무데도 없으면 not-found도 유죄)
- 산출물 규칙: `frameworks/output-correctness.md`
- CRAAP 점수화: `frameworks/craap-test.md`
- 위임: 탐색은 `source-scout`, 실재·인용 판정은 `citation-reviewer`

