이 문서는 AI 에이전트 섹션의 일부입니다.
가드레일이란?
가드레일(Guardrails) 은 AI 에이전트의 입력과 출력에 대한 안전 장치 입니다. 에이전트가 유해한 콘텐츠를 생성하거나, 개인정보를 유출하거나, 허용되지 않은 주제에 대해 답변하는 것을 방지합니다. Databricks의 AI Gateway 를 통해 Model Serving 엔드포인트에 가드레일을 적용할 수 있습니다.💡 비유: 가드레일은 도로의 “안전 가드레일”과 같습니다. 차량(AI)이 도로(허용 범위) 밖으로 나가지 않도록 물리적 장벽을 세우는 것입니다.
AI Gateway 가드레일 개념
AI Gateway는 Model Serving 엔드포인트 앞에 위치하는 프록시 계층 으로, 모든 요청과 응답을 모니터링하고 제어합니다.입력 필터 (Input Guardrails)
사용자의 요청이 에이전트에 도달하기 전에 필터링합니다.Safety Filter (안전 필터)
유해하거나 부적절한 콘텐츠를 자동으로 감지하고 차단합니다.Topic Filter (주제 필터)
에이전트가 답변해야 할 주제와 답변하지 말아야 할 주제를 명시합니다.💡 valid_topics와 invalid_topics: 둘 다 설정할 수 있으며, invalid_topics에 해당하면 valid_topics에 포함되더라도 차단됩니다.
출력 필터 (Output Guardrails)
에이전트의 응답이 사용자에게 전달되기 전에 필터링합니다.PII 필터 (개인정보 보호)
응답에 포함된 개인식별정보(PII)를 감지하고 처리합니다.
감지되는 PII 유형: