1.
V D, M B, M G J, I S S. A Hybrid Vision–Language Framework For Unified Image–Video Captioning And Semantic Visual Question Answering. IJAIML [Internet]. 2026 Jul. 19 [cited 2026 Aug. 24];6(7s):790-807. Available from: https://svedbergopen.com/index.php/ijaiml/article/view/1125