Skip to main content
이 문서는 GenAI 개념 섹션의 일부입니다.

한국어 프롬프트 작성 전략

한국어로 프롬프트를 작성할 때 알아두면 유용한 팁들입니다.

존댓말/반말 지정

System Prompt에서 응답 어투를 명시하면 일관성 있는 출력을 얻을 수 있습니다.

한영 혼용 전략

  • 기술 용어는 영어 유지가 더 정확합니다: “Transformer의 Attention 메커니즘을 설명하세요”가 “트랜스포머의 어텐션 메커니즘을 설명하세요”보다 정확한 응답을 생성합니다
  • 프롬프트 자체를 영어로 작성하고 “한국어로 답변하세요”를 추가 하면 더 정확한 경우도 있습니다 (특히 최신 기술 주제)

한국어 토큰 비용 절감 팁

한국어는 영어 대비 동일 의미를 전달하는 데 더 많은 토큰을 소비합니다. 비용 절감을 위해 프롬프트를 간결하게 작성하세요.
참고 : 불필요한 조사, 어미, 경어 표현을 줄이고 키워드 중심으로 프롬프트를 작성하면 토큰을 크게 절약할 수 있습니다. 다만 System Prompt의 역할 정의와 제약 조건은 정확성을 위해 충분히 상세하게 유지하세요.

한국어 특화 주의사항


프롬프트 디버깅: 원하는 결과가 안 나올 때

프롬프트가 제대로 작동하지 않을 때, 직감에 의존하지 말고 체계적으로 진단 해야 합니다.

증상별 진단 체크리스트

프롬프트 반복 개선 프로세스 (Iterative Refinement)

프롬프트 최적화는 한 번에 완성되지 않습니다. 다음 사이클을 반복하세요:
  1. 기본 프롬프트 작성— 핵심 지시와 기대 출력 형식을 정의
  2. 5~10개 테스트 케이스로 실행— 다양한 입력 유형을 포함
  3. 실패 케이스 분석— 어떤 유형의 입력이 실패하는가?
  4. 실패 원인별 프롬프트 수정— 위 진단 체크리스트 참조
  5. 다시 테스트— 수정이 기존 성공 케이스를 깨뜨리지 않는지 확인
  6. 반복— 목표 정확도에 도달할 때까지
성공 핵심: 프롬프트 엔지니어링은 “한 번에 완벽하게”가 아닌 “빠르게 반복하며 개선”하는 과정입니다. AI Playground에서 10번 반복하는 것이 30분 고민하는 것보다 효과적입니다.

토크나이저별 한국어 비교 데이터

동일한 한국어 문장이 토크나이저에 따라 완전히 다른 토큰 수 로 변환됩니다. 이는 비용과 컨텍스트 활용에 직접적인 영향을 미칩니다.

비교 테이블: 같은 문장, 다른 토큰 수

비용 영향 계산

주의 비용 절감 전략: 프롬프트 지시문(System Prompt)은 영어로 작성하고, 사용자 입력과 출력만 한국어로 처리하면 토큰 비용을 20~30% 절감할 수 있습니다. “Respond in Korean”만 추가하면 됩니다.

한국어 최적화 모델

범용 모델 외에 한국어에 특화된 학습 을 수행한 모델이 있습니다. 한국어 비중이 높은 서비스에서는 이들을 고려할 가치가 있습니다.

주요 한국어 특화 모델

벤치마크 비교 (KLUE, KorQuAD 기준)

언제 한국어 특화 모델을 선택하는가?


한국어 RAG 최적화

한국어 RAG 파이프라인에서는 형태소 분석(Kiwi 등), 한국어 임베딩 모델, 하이브리드 검색 등 특별한 고려가 필요합니다. 핵심 과제는 교착어 특성으로 인한 BM25 검색 실패, 한영 혼용 처리, 임베딩 품질 확보입니다.
한국어 RAG의 상세 구현 가이드(Kiwi 형태소 분석, BM25 Retriever, 임베딩 모델 비교, Re-ranking, 트러블슈팅)는 한국어 RAG 최적화 를 참고하세요.

한국어 고유 도전과 프롬프트 대응 전략

띄어쓰기 문제

한국어는 띄어쓰기가 없어도 의미가 통하는 경우가 많아, 사용자 입력에 띄어쓰기 오류가 빈번합니다. 프롬프트 대응 전략:

동음이의어 처리

존댓말 체계와 프롬프트

참고 : 존댓말 체계를 혼용하면 매우 어색한 출력이 됩니다. System Prompt에서 하나의 어투만 명확히 지정 하고, Few-shot 예시에도 동일한 어투를 사용하세요.

Structured Output 한국어 주의사항

JSON 내 한국어 이슈

한국어 정렬/정렬 문제


한국어 벤치마크 데이터

KLUE (Korean Language Understanding Evaluation)

한국어 NLU 표준 벤치마크입니다. 8개 과제로 구성됩니다.

KorQuAD 2.0

한국어 기계 독해 벤치마크입니다. 위키백과 기반 10,000+ Q&A 쌍으로 구성됩니다.
참고 벤치마크 활용 팁: KLUE와 KorQuAD 점수는 참고용 입니다. 실제 서비스 품질은 자사 도메인 데이터로 직접 평가해야 합니다. Databricks MLflow Evaluate를 사용하여 자사 한국어 Q&A 데이터셋으로 모델을 비교 평가하세요.