[1]
2024. Reducing Training Time and Enhancing Efficiency in Large Language Models: Ternary Output Quantization(TOQ). AI Journal of BUsiness. 1, 1 (Nov. 2024), 52–59.