모델 배포
모델은 ONNX 형식으로 Xisom 런타임에서 실행됩니다. 모델을 업로드하고, 입력 데이터소스와 페어링한 다음, 활성화하여 추론을 시작합니다.
지원 형식
섹션 제목: “지원 형식”- ONNX — 런타임은 ONNX 모델을 받아 하드웨어에 맞는 실행 공급자(TensorRT, CUDA, 또는 CPU)로 실행합니다. 모드는 하드웨어 설정을 참조하세요.
업로드, 페어링, 활성화
섹션 제목: “업로드, 페어링, 활성화”-
모델 업로드
섹션 제목: “모델 업로드”Models로 이동하여
.onnx파일을 업로드하세요. 플랫폼은 파일이 사용 가능해지기 전에 파일(확장자, 유형, 스키마)을 검증합니다. -
데이터소스와 페어링
섹션 제목: “데이터소스와 페어링”입력 데이터소스에서 이 모델을 페어링하세요. 여기서 호환성 검사가 실행됩니다. 윈도우 크기 또는 피처 수가 일치하지 않으면 페어링이 거부됩니다. 일치하도록 데이터소스 윈도우 크기를 조정하거나 모델을 다시 생성하세요.
-
활성화
섹션 제목: “활성화”데이터소스를 활성화한 다음 Start로 스트리밍을 시작하세요. 런타임은 페어링된 모델을 추론 서비스에 로드하고 예측값 생성을 시작합니다. 전체 루프는 첫 추론 실행하기를 참조하세요.
데모 시드 모델 교체
섹션 제목: “데모 시드 모델 교체”새로 설치하면 무작위 가중치를 가진 데모 모델이 함께 제공됩니다. 이를 교체하기 전까지 예측값은 의미가 없습니다. 위와 같이 학습된 모델을 업로드하거나, model-data 디렉터리에 넣고 추론 서비스를 재시작하세요. 파일 드롭 경로는 오프라인 번들 설치 페이지에서 다룹니다: 데모 모델 교체 (5단계).
문제가 발생하면
섹션 제목: “문제가 발생하면”- 업로드 거부, 페어링 실패, 또는 런타임이 모델을 로드하지 못하는 경우 — 문제 해결 런북을 참조하세요.
다음 단계
섹션 제목: “다음 단계” 입력 데이터소스 연결 라이브 센서 데이터로 모델에 데이터를 공급하세요.
예측값 모니터링 지연 시간, 처리량, KPI.
파이프라인 확인하기 Input → Model → Output 토폴로지를 시각화하고 실시간 연결을 확인하세요.