애플리케이션이 OpenTelemetry(OTel) 생성형 AI 트레이스를 뉴렐릭으로 전송하기 시작하면 AI 모니터링 보기에 다음이 표시됩니다:
- 서비스에서 수행한 모든 LLM 호출 — 프롬프트, 완료, 모델, 지연시간, 토큰 수, 종료 이유.
- 전체 요청 트레이스의 일부인 도구 호출 및 에이전트 단계를 통해 모델이 결정을 내린 이유를 확인할 수 있습니다.
- 오류, 속도 제한 실패 및 느린 호출이 나머지 APM 데이터와 함께 표시됩니다.
뉴렐릭 에이전트가 필요하지 않습니다. 앱에서 이미 OpenTelemetry 트레이스를 내보내고 있다면 거의 완료된 것입니다.
시작하기 전에
필요한 항목:
- 뉴렐릭 수집 라이선스 키.
- LLM을 호출하는 애플리케이션. OpenAI, Anthropic, LangChain 및 AWS Bedrock에 대한 파이썬 예제는 아래에 나와 있습니다. OpenTelemetry 생성형 AI 계측이 있는 다른 언어도 동일한 방식으로 작동합니다.
- 포트 443을 통해 앱에서 해당 리전의 뉴렐릭 OTLP 엔드포인트로 나가는 네트워크 이그레스. 리전 엔드포인트(US, EU 및 JP), 지원되는 포트 및 압축 설정의 전체 목록은 OpenTelemetry 프로토콜(OTLP)을 사용하여 뉴렐릭에 데이터 보내기를 참조하십시오.
중요
OTel 생성형 AI 계측은 사용자가 주고받는 정확한 프롬프트와 완료를 캡처할 수 있습니다. 여기에는 PII, 자격 증명 또는 규제 대상 데이터가 포함될 수 있습니다. 콘텐츠 캡처는 기본적으로 꺼져 있습니다. 이 기능을 켜기 전에 조직의 데이터 처리 정책을 검토하고 전송되는 프롬프트 및 완료 제어를 참조하십시오.
OpenTelemetry 익스포터를 뉴렐릭으로 지정
애플리케이션을 실행하는 프로세스에 다음 환경 변수를 설정합니다:
$# Replace with your region's OTLP endpoint — see the prerequisites above for the full list$export OTEL_EXPORTER_OTLP_ENDPOINT="<<YOUR_OTLP_ENDPOINT>>"$export OTEL_EXPORTER_OTLP_HEADERS="api-key=$NEW_RELIC_LICENSE_KEY"$
$# Name that will identify this service in New Relic$export OTEL_SERVICE_NAME="my-genai-service"올바른 계측 패키지를 추가합니다
애플리케이션에서 사용하는 것과 일치하는 섹션을 선택하세요. 둘 이상을 결합할 수 있습니다 ― 예를 들어 Bedrock을 호출하는 LangChain 애플리케이션은 둘 다 설치합니다.
팁
OpenTelemetry 생성형 AI 생태계에서는 정확한 패키지 이름과 버전이 빠르게 발전합니다. 팀에서 현재 지원하는 패키지에 대해서는 항상 OpenTelemetry 파이썬 contrib 레지스트리와 뉴렐릭 AI 모니터링 문서를 확인하십시오.
데이터가 도착하고 있는지 확인하세요
새로운 환경 변수와 계측이 적용되도록 애플리케이션을 다시 시작하세요.
소량의 실제 트래픽을 트리거합니다 ― 몇 번의 채팅 완료면 충분합니다.
뉴렐릭에서 Query Your Data 을(를) 열고 다음을 실행합니다:
SELECT count(*) FROM SpanWHERE gen_ai.system IS NOT NULL OR gen_ai.provider.name IS NOT NULLSINCE 30 minutes agoFACET service.name, gen_ai.operation.name몇 분(2~5분) 내에 서비스 이름과 작업(예:
chat,completion,embeddings).APM & Services > AI Monitoring (으)로 이동하여 서비스를 선택하여 AI Traces 뷰가 채워지는 것을 확인하십시오.
전송되는 프롬프트 및 완료 제어
기본적으로 대부분의 OpenTelemetry 생성형 AI 계측은 프롬프트 또는 완료 텍스트를 캡처하지 않습니다. 스팬에는 모델, 토큰 수, 지연시간 및 상태가 포함되지만 메시지 본문은 포함되지 않습니다.
AI 모니터링에서 메시지 콘텐츠를 볼 수 있게 하려면 명시적으로 옵트인하십시오. 플래그 이름은 설치한 계측 패키지에 따라 다릅니다 — 해당 특정 패키지의 문서를 확인하십시오. 일반적인 예는 다음과 같습니다:
OTEL_INSTRUMENTATION_GENAI_CAPTURE_MESSAGE_CONTENT=trueOpenTelemetry에서 유지 관리하는 계측의 경우.TRACELOOP_TRACE_CONTENT=true커뮤니티(OpenLLMetry-family) 계측용.
프로덕션에서 콘텐츠 캡처를 활성화하기 전에:
- 프롬프트에 포함된 데이터를 검토하십시오. 사용자가 PII, 자격 증명 또는 규제 대상 데이터를 제출하는 경우, 뉴렐릭으로 전송되기 전에 드롭 필터 또는 속성 수준 난독화를 사용하여 특정 필드를 제거하거나 해시하는 것을 권장합니다. 뉴렐릭의 데이터 처리 문서를 참조하십시오.
- 조직의 보존 및 규정 준수 요구 사항(GDPR, HIPAA, PCI 등)을 확인하십시오.
메시지 본문이 아닌 지연시간, 토큰 및 오류 가시성만 필요한 경우 콘텐츠 캡처를 비활성화된 상태로 둡니다.
문제 해결
표시되는 내용 | 시도할 작업 |
|---|---|
3단계의 쿼리가 0개의 행을 반환합니다. | OTLP 엔드포인트가 계정의 리전과 일치하는지, |
스팬이 도착하지만 서비스의 AI 모니터링 보기가 비어 있습니다 | 스팬이 예상되는 생성형 AI 속성으로 태그 지정되지 않았을 수 있습니다. 계측 패키지를 업그레이드하거나 샘플 스팬과 함께 뉴렐릭 지원팀에 문의하세요. |
긴 프롬프트가 잘립니다. | 애플리케이션 측에서 |
토큰 수가 누락되었습니다 | LLM 제공자가 이를 반환했지만, 계측 버전이 아직 이를 기록하지 않습니다. 계측 패키지를 업그레이드하세요. |
AI 모니터링에 트레이스는 표시되지만 프롬프트/완료는 비어 있습니다 | 콘텐츠 캡처가 비활성화되어 있습니다. 전송되는 프롬프트 및 완료 제어를 참조하십시오. |
AI 모니터링을 사용할 수 있을 것으로 예상했지만 뷰가 나타나지 않습니다. | 계정에서 AI 모니터링이 활성화되어 있는지 확인하려면 뉴렐릭 계정 팀에 문의하십시오. |
도움을 받으세요
위의 단계를 수행한 후에도 문제가 해결되지 않는 경우:
- 뉴렐릭 지원 케이스를 접수하고 샘플 스팬 페이로드와 서비스 이름을 포함하세요.
- 계정 수준 설정 질문은 뉴렐릭 계정 팀에 문의하세요.
- 일반적인 OpenTelemetry 생성형 AI 질문에 대해서는 OpenTelemetry 생성형 AI 시맨틱 컨벤션이 권위 있는 참고 자료입니다.