[1]
R. Jain, R. Shah, K. Kanadia, J. Jain, D. K. Ghag, and D. M. Narvekar, “Embedding Instability Score for Detecting Backdoor Attacks in NLP Models”, IJAIML, vol. 6, no. 3, pp. 242–250, Sep. 2026.