Optimizing AI models for deployment on resource-constrained edge devices.
Optimization Techniques
- Model quantization and pruning
- TensorRT acceleration
- ONNX model conversion
- Real-time inference optimization
- Memory-efficient architectures
Platforms
- NVIDIA Jetson family (Orin, Nano)
- Edge TPU devices
- ARM-based embedded systems