跳至主要內容
Int8量化技术原理讲解

Int8量化技术原理讲解

Int量化技术是一种节约大模型推理或训练的过程中占用的显存的技术。量化的目是为了减少计算时间和计算能耗 。在一些场景下对能耗和时间的要求,要高于模型的指标,所以在这种情况下量化是一个必然的选择。


最后的开神-wkyc大约 2 分钟微调技术优化内存机器学习