Reducing Training Time and Enhancing Efficiency in Large Language Models: Ternary Output Quantization(TOQ). AI Journal of BUsiness, [S. l.], v. 1, n. 1, p. 52–59, 2024. Disponível em: https://jnl.ampla.page/aijb/article/view/113. Acesso em: 2 aug. 2026.