humanize: 한국어 글 자연스럽게 다듬기
AI가 쓴 티가 나는 한국어 글을 사람이 쓴 것처럼 다듬는다. 아래 원칙을 순서대로 적용하고, 다듬은 뒤 검증으로 확인한다.
의미는 바꾸지 않는다. 어투와 문장부호, 문장 흐름만 손본다.
원칙
1. em dash(—)를 쓰지 않는다
문장 중간의 삽입이나 부연은 한국어에서 자연스러운 부호로 바꾼다.
- 짧은 부연은 괄호
( )로. - 문장을 이어붙였다면 마침표로 끊거나 쉼표로.
- 라벨과 설명을 구분할 때는 콜론
:으로.
예: 차단한다 — 청구내역은 할부가 12줄로 쪼개져 있어서 → 차단한다. 청구내역은 할부가 12줄로 쪼개져 있어서
2. 장식용 이모지를 넣지 않는다
👤 🏦 📄 ✅ ❌ 같은 장식 이모지는 뺀다. 전달할 의미가 있으면 말로 쓴다.
예: ❌ 서버가 API로 당겨오지 않음 → 서버가 API로 당겨오지 않음
3. 한국어에서 잘 안 쓰는 부호를 피한다
- 가운뎃점(·)은 짧은 병렬(
국민·기업)에 자연스럽다. 그대로 둔다. - 화살표(→)는 순서나 흐름을 명확히 보일 때는 유지한다(다이어그램,
법령 → 행정규칙). - 세미콜론(;), 불필요한 슬래시(/), 물결표(~) 남용은 정리한다.
4. 명사 서술어의 -이다를 다듬는다
체언이 모음으로 끝나는 경우 서술격 조사 이다의 이-가 생략되어 -다로 나타날 수 있다. 두 형태 모두 문법적으로 맞지만, 격식적인 글에서는 이-를 생략하지 않은 -이다가 선호되는 경향이 있다.
따라서 정의문이나 보고서처럼 격식을 갖춘 문장에서는 문맥에 따라 완전한 -이다 형태를 우선한다. 다만 원문의 문체가 간결한 -다체라면 일관성과 자연스러움을 고려해 그대로 둘 수 있다.
한눈에 정리한 문서다→한눈에 정리한 문서이다이 서비스의 핵심 기능은 자동 판정이다→ 그대로 유지사용자가 입력값을 확인한다→ 동사 종결이므로 이 규칙과 무관
5. 문장을 매끄럽게 만든다
- 한 문장이 너무 길면 끊는다.
- 기계 번역 같은 연결("
에 있어서", "하는 것을 통해")은 자연스러운 표현으로 바꾼다. - 습관적인 부사와 군더더기("사실상", "기본적으로", 불필요한 "매우")를 덜어낸다.
- 볼드와 불릿을 남발하지 않는다. 정말 중요한 것에만 쓴다.
6. 조어와 은유로 뭉뚱그린 문장을 뜻이 드러나게 푼다
사람이 한 번 읽고 바로 이해되지 않고 뜻을 되짚게 만드는 문장이 대상이다. 판별 기준은 하나다. "사람이 썼다면 이렇게 안 썼을 것 같은가."
- 동사를 명사로 굳힌 조어를 문장 안에서 홀로 명사로 쓰지 않는다. 동사로 풀거나 온전한 명사로 바꾼다. 단, 표 셀이나 필드 이름 같은 라벨 자리에서는 짧은 조어가 기능적이니 그대로 둔다.
- 예:
되묻기가 오면 다시 계산한다→사용자가 확인 질문에 답하면 다시 계산한다
- 예:
- 은유로 의미를 압축하지 않는다. "여기", "되감는다"처럼 독자가 대상과 동작을 되짚어야 하는 표현은 주어와 동작을 그대로 풀어 쓴다.
- 예:
되묻기가 여기를 되감는다→사용자가 답하면 집계를 다시 계산해야 한다
- 예:
- 뭉뚱그린 구어 동사를 정확한 동사로 바꾼다.
- 예:
집계를 돌린다→집계를 계산한다,judge()를 다시 돌린다→judge()를 다시 실행한다
- 예:
적용 방법
- 대상 글을 위 1~6 순서로 훑으며 고친다.
- 코드 식별자, 조문, 고유명사 같은 용어는 그대로 둔다.
- 원문의 뜻과 사실관계는 유지한다.
검증
다듬은 뒤 확인한다.
- 본문에
—(em dash)가 남아 있지 않은가. - 장식 이모지가 남아 있지 않은가.
- 처음 읽는 사람이 되짚지 않고 한 번에 이해되는 문장인가. 조어·은유·구어 동사로 뭉뚱그린 데는 없는가.
- 뜻이 원문과 같은가.
간단한 스캔 예:
grep -n "—" 대상파일 # 결과가 없어야 한다