Communication-aware Quantization for Deep Learning Inference Parallelization on Chiplet-based Accelerators

Communication-aware Quantization for Deep Learning Inference Parallelization on Chiplet-based Accelerators | IEEE Conference Publication | IEEE Xplore

IEEE Account

Purchase Details

Profile Information

Need Help?