Reducing Training Time and Enhancing Efficiency in Large Language Models: Ternary Output Quantization(TOQ). (2024). AI Journal of BUsiness, 1(1), 52-59. https://jnl.ampla.page/aijb/article/view/113