Bỏ qua để đến nội dung

Triển khai mô hình

Các mô hình chạy trên runtime Xisom ở định dạng ONNX. Bạn tải lên một mô hình, ghép cặp với một nguồn dữ liệu đầu vào, và kích hoạt nó để bắt đầu suy luận.

Màn hình Model Manager liệt kê các mô hình ONNX đã triển khai cùng datasource ghép cặp và trạng thái Màn hình Model Manager liệt kê các mô hình ONNX đã triển khai cùng datasource ghép cặp và trạng thái
Model Manager — tải lên bundle ONNX, ghép cặp với datasource, và kích hoạt.
  • ONNX — runtime chấp nhận các mô hình ONNX và thực thi chúng với execution provider phù hợp với phần cứng của bạn (TensorRT, CUDA, hoặc CPU). Xem Thiết lập phần cứng để biết các chế độ.
  1. Vào Models và tải lên tệp .onnx của bạn. Nền tảng xác thực tệp (phần mở rộng, loại, và schema) trước khi nó sẵn sàng sử dụng.

  2. Trên một nguồn dữ liệu đầu vào, ghép cặp mô hình này. Quá trình kiểm tra tương thích chạy ở đây — nếu kích thước cửa sổ hoặc số lượng đặc trưng không khớp, việc ghép cặp sẽ bị từ chối. Điều chỉnh kích thước cửa sổ của datasource hoặc tạo lại mô hình để khớp.

  3. Bật datasource, sau đó Start luồng dữ liệu. Runtime tải mô hình đã ghép cặp vào dịch vụ suy luận và bắt đầu tạo ra các dự đoán. Xem Lần suy luận đầu tiên của bạn để biết toàn bộ vòng lặp.

Một bản cài đặt mới đi kèm một mô hình demo với trọng số ngẫu nhiên — các dự đoán vô nghĩa cho đến khi bạn thay thế nó. Tải lên mô hình đã huấn luyện của bạn như trên, hoặc thả nó vào thư mục model-data và khởi động lại dịch vụ suy luận. Trang cài đặt từ gói offline trình bày cách thả tệp: Thay thế mô hình demo (bước 5).

  • Tải lên bị từ chối, ghép cặp thất bại, hoặc runtime không tải được mô hình — xem runbook Khắc phục sự cố.