Guardrails 노드 문서
Guardrails 노드를 사용하여 텍스트에 안전, 보안 및 콘텐츠 정책을 적용하세요. 이 노드를 사용하면 사용자 입력을 AI 모델로 보내기 전에 검증하거나, AI 모델의 _출력_을 워크플로에서 사용하기 전에 확인할 수 있습니다. Note LLM 기반 Guardrails에는 Chat Model 연결이 필요합니다 이 노드는 LLM 기반 guardrail과 함께 Check Text for Violations 작업을 사용할 때 Model 입력에 Chat Model 노드가 연결되어 있어야 합니다. Jailbreak, NSFW, Topical Alignment와 같은 많은 guardrail 검사는 LLM 기반이며, 이 연결을 사용하여 입력 텍스트를 평가합니다. 노드 매개변수 # 다음 매개변수를 사용하여 Guardrails 노드를 구성하세요. 작업 # 이 노드의 동작을 정의하는 작업 모드입니다. Check Text for Violations : 전체 guardrail 세트를 제공합니다. 위반 사항이 발생하면 항목이 Fail 분기로 전송됩니다. Sanitize Text : URL, 정규식, 시크릿 키, 전화번호나 신용카드 번호와 같은 개인 식별 정보(PII)를 탐지할 수 있는 guardrail의 하위 집합을 제공합니다. 이 노드는 탐지된 위반 사항을 자리표시자로 대체합니다. 확인할 텍스트 # guardrail이 평가하는 텍스트입니다. 일반적으로 사용자 쿼리 텍스트나 AI 모델의 응답과 같이 이전 노드의 표현식을 사용하여 이 텍스트를 매핑합니다. Guardrails # Text To Check 에 적용할 하나 이상의 guardrail을 선택하세요. 목록에서 guardrail을 추가하면 아래에 해당 guardrail의 구성 옵션이 표시됩니다. Keywords: 지정된 키워드가 입력 텍스트에 나타나는지 확인합니다. Keywords : 차단할 단어의 쉼표로 구분된 목록입니다. Jailbreak: AI 안전 조치를 우회하거나 모델을 악용하려는 시도를 탐지합니다. Customize Prompt : (불리언) 이 옵션을 켜면 jailbreak 탐지 모델의 기본 프롬프트가 있는 텍스트 입력이 나타납니다. guardrail을 세밀하게 조정하기 위해 이 프롬프트를 변경할 수 있습니다. Threshold : 0.0에서 1.0 사이의 값입니다. 이는 입력을 jailbreak 시도로 표시하는 데 필요한 AI 모델의 신뢰 수준을 나타냅니다. 값이 높을수록 더 엄격합니다. NSFW: 업무에 적합하지 않은(Not Safe For Work, NSFW) 콘텐츠를 생성하려는 시도를 탐지합니다. Customize Prompt : (불리언) 이 옵션을 켜면 NSFW 탐지 모델의 기본 프롬프트가 있는 텍스트 입력이 나타납니다. guardrail을 세밀하게 조정하기 위해 이 프롬프트를 변경할 수 있습니다. Threshold : 콘텐츠를 NSFW로 표시하는 데 필요한 신뢰 수준을 나타내는 0.0에서 1.0 사이의 값입니다. PII: 텍스트에서 개인 식별 정보(PII)를 탐지합니다. Type