Publications
Peer-reviewed papers and preprints in multimodal AI, model evaluation, visualization intelligence, and low-resource NLP.
2026
-
arXiv Preprint
Fine-Grained Benchmark Generation for Comprehensive Evaluation of Foundation Models
-
ACL Findings
Lost in Translation: Do LVLM Judges Generalize Across Languages?
-
LoResLM Workshop
BanglaSummEval: Reference-Free Factual Consistency Evaluation for Bangla Summarization
-
EACL Findings
DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards
-
EACL Conference
Aligning Text, Code, and Vision: A Multi-Objective Reinforcement Learning Framework for Text-to-Visualization
2025
-
arXiv Preprint
LLM-Based Data Science Agents: A Survey of Capabilities, Challenges, and Future Directions
-
arXiv Preprint
Open-PMC-18M: A High-Fidelity Large-Scale Medical Dataset for Multimodal Representation Learning
-
Thesis Thesis
Toward Trustworthy Automated Data Story Generation: Benchmarking, Multi-Agent Generation and Bias Evaluation in Data Storytelling
-
EMNLP Industry
Deploying Tiny LVLM Judges for Real-World Evaluation of Chart Models: Lessons Learned and Best Practices
-
IEEE VIS Conference
The Perils of Chart Deception: How Misleading Visualizations Affect Vision-Language Models
-
EMNLP Conference
From Charts to Fair Narratives: Uncovering and Mitigating Geo-Economic Biases in Chart-to-Text
-
ACL Industry
Judging the Judges: Can Large Vision-Language Models Fairly Evaluate Chart Comprehension and Reasoning?
-
ACL Findings
ChartQAPro: A More Diverse and Challenging Benchmark for Chart Question Answering
-
CGF Journal
Natural Language Generation for Visualizations: State of the Art, Challenges and Future Directions
2024
-
EMNLP Conference
DataNarrative: Automated Data-Driven Storytelling with Visualizations and Texts
-
EMNLP Findings
Are Large Vision Language Models up to the Challenge of Chart Comprehension and Reasoning? An Extensive Investigation into the Capabilities and Limitations of LVLMs
-
LREC-COLING Conference
BenLLM-Eval: A Comprehensive Evaluation into the Potentials and Pitfalls of Large Language Models on Bengali NLP
2023
-
Canadian AI Conference
Multihop Factual Claim Verification Using Natural Language Prompts
2022
-
Sensors Journal
Explainable Artificial Intelligence Model for Stroke Prediction Using EEG Signal
-
ICECE Conference
Gender-Based Cyberbullying Detection for Under-Resourced Bangla Language
-
ICCIT Conference
An Efficient Approach to Automatic Tag Prediction from Movie Plot Synopses Using Transformer-Based Language Model
-
EMNLP Findings
BanglaRQA: A Benchmark Dataset for Under-Resourced Bangla Language Reading Comprehension-Based Question Answering with Diverse Question-Answer Types
2019
-
IUT Other
Improving Deep Learning Based Recommender Systems Using Dimensionality Reduction Methodologies
For current citation counts, visit my Google Scholar profile .