“Energy-Efficient NLP Through Tiny-Model Distillation, Pruning, and Quantized Inference” (2026) Kashf Journal of Multidisciplinary Research, 3(05), pp. 1–8. doi:10.71146/kjmr965.