Shaobo Ma, Chao Fang, Haikuo Shao, Zhongfeng Wang: Efficient Arbitrary Precision Acceleration for Large Language Models on GPU Tensor Cores. ASP-DAC 2025: 1181-1187