Thiết lập phần cứng
Xisom Edge AI Box chạy trên NVIDIA Jetson. Hãy chuẩn bị thiết bị, kiểm tra cách suy luận dùng GPU, và đấu nối vào mạng nhà máy trước khi cài phần mềm.
Phần cứng được hỗ trợ
Phần tiêu đề “Phần cứng được hỗ trợ”| Hạng mục | Yêu cầu |
|---|---|
| Thiết bị | NVIDIA Jetson TX2 |
| Hệ điều hành | JetPack 4.5 (L4T r32.5) |
| Suy luận | ONNX Runtime trên GPU tích hợp (CUDA), có dự phòng CPU |
| Bộ nhớ | 4 GB trở lên. Trình cài đặt cảnh báo khi dưới khoảng 3.5 GB. |
| Dung lượng đĩa trống | Khoảng 6 GB tại nơi bạn sao chép gói phát hành |
Điều kiện tiên quyết cho GPU
Phần tiêu đề “Điều kiện tiên quyết cho GPU”Image JetPack phải có sẵn những thứ sau trước khi bạn cài Xisom. Trình cài đặt kiểm tra chúng và dừng lại nếu thiếu. Nó không tự cài chúng.
- NVIDIA container runtime, đã đăng ký với Docker.
docker infophải liệt kê runtimenvidia. - Một hệ thống Jetson (L4T) thật. Trình cài đặt tìm tệp
/etc/nv_tegra_release.
Cách suy luận dùng GPU
Phần tiêu đề “Cách suy luận dùng GPU”Dịch vụ suy luận chọn một execution provider khi khởi động. Trên TX2, nó dùng CUDA, và tụt xuống CPU nếu CUDA không khởi động được. Bảng điều khiển hiển thị provider đang hoạt động.
Chế độ bình thường. Mô hình chạy trên GPU tích hợp của TX2 qua CUDA. Bảng điều khiển hiển thị CUDA.
- Cần NVIDIA container runtime trên host.
- Xuất mô hình với ONNX opset 15 trở xuống. Xem Chuẩn bị mô hình với modelctl.
- Ở lần khởi động đầu, dịch vụ suy luận khởi tạo CUDA. Health check của nó cho phép
giai đoạn khởi động 90 giây, nên nó hiển thị
startingtối đa khoảng một phút rưỡi. Đây là điều dự kiến.
Lưới an toàn. Nếu CUDA không khởi động được, dịch vụ tụt xuống CPU. Suy luận vẫn tiếp tục, với độ trễ cao hơn. Bảng điều khiển hiển thị CPU (fallback) — huy hiệu này là tín hiệu đáng tin cậy. Cảnh báo chỉ được ghi khi container hoàn toàn không có CUDA provider.
- Để hộp từ chối khởi động thay vì tụt xuống CPU, xem Chạy trên CPU khi đáng lẽ phải dùng GPU.
TX2 không dùng TensorRT. Bản build ONNX Runtime cho JetPack 4.5 cần một TensorRT mới hơn bản mà nền tảng cung cấp, nên dịch vụ bỏ qua nó và chạy trên CUDA. Không có bước biên dịch engine ở lần khởi động đầu.
Yêu cầu về mạng
Phần tiêu đề “Yêu cầu về mạng”- Một kết nối LAN mà trình duyệt của người vận hành truy cập được. Bảng điều khiển lắng nghe ở cổng 80 (và 3000 làm cổng thay thế), hoặc 443 khi bạn bật HTTPS.
- Một đường tới các thiết bị nhà máy: máy chủ OPC UA, broker MQTT và PLCs.
- Không cần truy cập internet đi ra. Bạn cài đặt và cập nhật từ gói offline.
Cổng nội bộ của dịch vụ suy luận (50051) chỉ gắn vào địa chỉ loopback của hộp. Không thể truy cập nó từ mạng.
Lần boot đầu tiên
Phần tiêu đề “Lần boot đầu tiên”- Cắm nguồn và cáp mạng.
- Truy cập URL bảng điều khiển mà trình cài đặt đã in: mặc định là
http://<box-ip>, hoặchttps://<box-ip>nếu bạn đã bật HTTPS. - Đăng nhập bằng
adminvới mật khẩu mà trình cài đặt đã in. - Tiếp tục đến Kết nối một nguồn dữ liệu đầu vào.
Nếu có gì đó sai
Phần tiêu đề “Nếu có gì đó sai”- Hộp chạy trên CPU (fallback), hoặc suy luận kẹt ở
unhealthysau giai đoạn khởi động — xem runbook Khắc phục sự cố.