콘텐츠로 이동

모델 배포

모델은 ONNX 형식으로 Xisom 런타임에서 실행됩니다. 모델을 업로드하고, 입력 데이터소스와 페어링한 다음, 활성화하여 추론을 시작합니다.

페어링된 데이터소스와 상태와 함께 배포된 ONNX 모델 목록을 보여주는 모델 관리자 화면 페어링된 데이터소스와 상태와 함께 배포된 ONNX 모델 목록을 보여주는 모델 관리자 화면
모델 관리자 — ONNX 번들 업로드, 데이터소스 페어링, 활성화.
  • ONNX — 런타임은 ONNX 모델을 받아 하드웨어에 맞는 실행 공급자(TensorRT, CUDA, 또는 CPU)로 실행합니다. 모드는 하드웨어 설정을 참조하세요.
  1. Models로 이동하여 .onnx 파일을 업로드하세요. 플랫폼은 파일이 사용 가능해지기 전에 파일(확장자, 유형, 스키마)을 검증합니다.

  2. 입력 데이터소스에서 이 모델을 페어링하세요. 여기서 호환성 검사가 실행됩니다. 윈도우 크기 또는 피처 수가 일치하지 않으면 페어링이 거부됩니다. 일치하도록 데이터소스 윈도우 크기를 조정하거나 모델을 다시 생성하세요.

  3. 데이터소스를 활성화한 다음 Start로 스트리밍을 시작하세요. 런타임은 페어링된 모델을 추론 서비스에 로드하고 예측값 생성을 시작합니다. 전체 루프는 첫 추론 실행하기를 참조하세요.

새로 설치하면 무작위 가중치를 가진 데모 모델이 함께 제공됩니다. 이를 교체하기 전까지 예측값은 의미가 없습니다. 위와 같이 학습된 모델을 업로드하거나, model-data 디렉터리에 넣고 추론 서비스를 재시작하세요. 파일 드롭 경로는 오프라인 번들 설치 페이지에서 다룹니다: 데모 모델 교체 (5단계).

  • 업로드 거부, 페어링 실패, 또는 런타임이 모델을 로드하지 못하는 경우 — 문제 해결 런북을 참조하세요.