Skip to main content
이 문서는 AI 에이전트 섹션의 일부입니다.

가드레일이란?

가드레일(Guardrails) 은 AI 에이전트의 입력과 출력에 대한 안전 장치 입니다. 에이전트가 유해한 콘텐츠를 생성하거나, 개인정보를 유출하거나, 허용되지 않은 주제에 대해 답변하는 것을 방지합니다. Databricks의 AI Gateway 를 통해 Model Serving 엔드포인트에 가드레일을 적용할 수 있습니다.
💡 비유: 가드레일은 도로의 “안전 가드레일”과 같습니다. 차량(AI)이 도로(허용 범위) 밖으로 나가지 않도록 물리적 장벽을 세우는 것입니다.

AI Gateway 가드레일 개념

AI Gateway는 Model Serving 엔드포인트 앞에 위치하는 프록시 계층 으로, 모든 요청과 응답을 모니터링하고 제어합니다.

입력 필터 (Input Guardrails)

사용자의 요청이 에이전트에 도달하기 전에 필터링합니다.

Safety Filter (안전 필터)

유해하거나 부적절한 콘텐츠를 자동으로 감지하고 차단합니다.
Safety 필터가 감지하는 항목:

Topic Filter (주제 필터)

에이전트가 답변해야 할 주제와 답변하지 말아야 할 주제를 명시합니다.
💡 valid_topics와 invalid_topics: 둘 다 설정할 수 있으며, invalid_topics에 해당하면 valid_topics에 포함되더라도 차단됩니다.

출력 필터 (Output Guardrails)

에이전트의 응답이 사용자에게 전달되기 전에 필터링합니다.

PII 필터 (개인정보 보호)

응답에 포함된 개인식별정보(PII)를 감지하고 처리합니다.
감지되는 PII 유형:

키워드 필터

특정 키워드가 포함된 응답을 차단합니다.

Rate Limiting (속도 제한)

에이전트의 남용을 방지하기 위해 요청 수를 제한합니다.

Rate Limit 설정 옵션


전체 설정 예제


가드레일 차단 시 동작

가드레일에 의해 요청이 차단되면, 사용자에게 안전한 기본 응답이 반환됩니다.

모니터링

가드레일의 활동은 Inference Tables에 자동으로 기록됩니다.

정리


참고 링크