NVIDIA Nemotron Chat Model 노드 문서
n8n에서 NVIDIA Nemotron Chat Model 노드를 사용하는 방법을 설명합니다. 대화형 AI 에이전트와 함께 NVIDIA Nemotron 모델을 워크플로에 연동하는 방법과 노드 파라미터 및 옵션을 설명합니다.
NVIDIA Nemotron Chat Model 노드를 사용하면 대화형 AI 에이전트 와 함께 NVIDIA Nemotron {:target="_blank" .external-link} 모델에 액세스할 수 있습니다. 이 노드는 build.nvidia.com {:target="_blank" .external-link}에 호스팅된 Nemotron 모델과 셀프 호스팅된 NVIDIA Inference Microservices(NIM)에서 모두 동작합니다. 이 페이지에서는 NVIDIA Nemotron Chat Model 노드의 파라미터와 추가 리소스 링크를 확인할 수 있습니다. 자격 증명 이 노드의 인증 정보는 여기 에서 확인할 수 있습니다. 서브 노드에서의 파라미터 해석 서브 노드는 표현식을 사용하여 여러 항목을 처리할 때 다른 노드와 다르게 동작합니다. 루트 노드를 포함한 대부분의 노드는 임의 수의 항목을 입력으로 받아 처리한 후 결과를 출력합니다. 표현식을 사용하여 입력 항목을 참조할 수 있으며, 노드는 각 항목에 대해 순서대로 표현식을 해석합니다. 예를 들어, 5개의 name 값이 입력된 경우 {{ $json.name }} 표현식은 각 이름을 순서대로 해석합니다. 서브 노드에서는 표현식이 항상 첫 번째 항목으로 해석됩니다. 예를 들어, 5개의 name 값이 입력된 경우 {{ $json.name }} 표현식은 항상 첫 번째 이름으로 해석됩니다. 노드 파라미터 # Model # 완성(completion)을 생성하는 데 사용할 Nemotron 모델을 선택합니다. n8n은 자격 증명에 설정된 엔드포인트에서 Nemotron 모델을 동적으로 로드합니다. n8n이 엔드포인트에 도달할 수 없는 경우, 잘 알려진 Nemotron 모델 ID의 선별된 목록으로 폴백합니다. 노드 옵션 # 다음 옵션을 사용하여 노드의 동작을 더욱 세부적으로 조정할 수 있습니다. Frequency Penalty # 이 옵션을 사용하여 모델이 자신을 반복할 확률을 제어합니다. 값이 높을수록 모델이 반복될 확률이 줄어듭니다. Maximum Number of Tokens # 완성(completion) 길이를 설정하는 최대 토큰 수를 입력합니다. 모델 기본값을 사용하려면 -1 을 입력하세요. Response Format # Text 또는 JSON 을 선택합니다. JSON 을 선택하면 모델이 유효한 JSON을 반환하도록 보장합니다. JSON 을 선택할 경우, 체인 또는 에이전트의 프롬프트에 json 이라는 단어를 포함하세요. Presence Penalty # 이 옵션을 사용하여 모델이 새로운 주제에 대해 이야기할 확률을 제어합니다. 값이 높을수록 모델이 새로운 주제를 다룰 확률이 높아집니다. Sampling Temperature # 이 옵션을 사용하여 샘플링 프로세스의 무작위성을 제어합니다. 온도가 높을수록 더 다양한 샘플링이 이루어지지만, 환각(hallucination) 위험이 증가합니다. Timeout # 최대 요청 시간(밀리초)을 입력합니다. Max Retries # 요청 재시도 최대