[1]
Nanang Kurnia Alfian and Robert Marco, “LLM Token Consumption Optimization Using BERT Pre-filtering and Retrieval-Augmented Generation (RAG)”, esaprom, vol. 5, no. 09, pp. 2342–2347, Sep. 2026.