Efficient Network Inference via Hardware-Aware Architecture Search, Model Pruning & Quantization | ResearchPod