(1)
V, D.; M, B.; M G, J.; I S, S. A Hybrid Vision–Language Framework For Unified Image–Video Captioning And Semantic Visual Question Answering. IJAIML 2026, 6, 790-807.