Publications

Peer-reviewed papers and preprints in multimodal AI, model evaluation, visualization intelligence, and low-resource NLP.

2026

  1. arXiv Preprint

    Fine-Grained Benchmark Generation for Comprehensive Evaluation of Foundation Models

    Mohammed Saidul Islam , Negin Baghbanzadeh , Farnaz Kohankhaki , Afshin Cheraghi , Ali Kore , Shayaan Mehdi , Elham Dolatabadi and Arash Afkanpour
    arXiv preprint arXiv:2605.188242026
  2. ACL Findings

    Lost in Translation: Do LVLM Judges Generalize Across Languages?

    Md Tahmid Rahman Laskar , Mohammed Saidul Islam , Mir Tafseer Nayeem , Amran Bhuiyan , Mizanur Rahman , Shafiq Joty , Enamul Hoque and Jimmy Huang
    Findings of the Association for Computational Linguistics: ACL 20262026
  3. LoResLM Workshop

    BanglaSummEval: Reference-Free Factual Consistency Evaluation for Bangla Summarization

    Ahmed Rafid , Rumman Adib , Fariya Ahmed , Ajwad Abrar and Mohammed Saidul Islam
    Proceedings of the Second Workshop on Language Models for Low-Resource Languages2026
  4. EACL Findings

    DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards

    Aaryaman Kartha , Ahmed Masry , Mohammed Saidul Islam , Thinh Lang , Shadikur Rahman , Ridwan Mahbub , Mizanur Rahman , Mahir Ahmed , Md Rizwan Parvez , Enamul Hoque and Shafiq Joty
    Findings of the Association for Computational Linguistics: EACL 20262026
  5. EACL Conference

    Aligning Text, Code, and Vision: A Multi-Objective Reinforcement Learning Framework for Text-to-Visualization

    Mizanur Rahman , Mohammed Saidul Islam , Md Tahmid Rahman Laskar , Shafiq Joty and Enamul Hoque
    Proceedings of the 19th Conference of the European Chapter of the Association for Computational Linguistics2026

2025

  1. arXiv Preprint

    LLM-Based Data Science Agents: A Survey of Capabilities, Challenges, and Future Directions

    Mizanur Rahman , Amran Bhuiyan , Mohammed Saidul Islam , Md Tahmid Rahman Laskar , Ridwan Mahbub , Ahmed Masry , Shafiq Joty and Enamul Hoque
    arXiv preprint arXiv:2510.040232025
  2. arXiv Preprint

    Open-PMC-18M: A High-Fidelity Large-Scale Medical Dataset for Multimodal Representation Learning

    Negin Baghbanzadeh , Mohammed Saidul Islam , Sajad Ashkezari , Elham Dolatabadi and Arash Afkanpour
    arXiv preprint arXiv:2506.027382025
  3. Thesis Thesis

    Toward Trustworthy Automated Data Story Generation: Benchmarking, Multi-Agent Generation and Bias Evaluation in Data Storytelling

    Mohammed Saidul Islam
    York University2025
  4. EMNLP Industry

    Deploying Tiny LVLM Judges for Real-World Evaluation of Chart Models: Lessons Learned and Best Practices

    Md Tahmid Rahman Laskar , Mohammed Saidul Islam , Ridwan Mahbub , Mizanur Rahman , Amran Bhuiyan , Israt Jahan , Mir Tafseer Nayeem , Shafiq Joty , Enamul Hoque and Jimmy Xiangji Huang
    Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing: Industry Track2025
  5. IEEE VIS Conference

    The Perils of Chart Deception: How Misleading Visualizations Affect Vision-Language Models

    Ridwan Mahbub , Mohammed Saidul Islam , Md Tahmid Rahman Laskar , Mizanur Rahman , Mir Tafseer Nayeem and Enamul Hoque
    IEEE VIS 20252025
  6. EMNLP Conference

    From Charts to Fair Narratives: Uncovering and Mitigating Geo-Economic Biases in Chart-to-Text

    Ridwan Mahbub , Mohammed Saidul Islam , Mir Tafseer Nayeem , Md Tahmid Rahman Laskar , Mizanur Rahman , Shafiq Joty and Enamul Hoque
    Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing2025
  7. ACL Industry

    Judging the Judges: Can Large Vision-Language Models Fairly Evaluate Chart Comprehension and Reasoning?

    Md Tahmid Rahman Laskar , Mohammed Saidul Islam , Ridwan Mahbub , Ahmed Masry , Mizanur Rahman , Amran Bhuiyan , Mir Tafseer Nayeem , Shafiq Joty , Enamul Hoque and Jimmy Xiangji Huang
    Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics: Industry Track2025
  8. ACL Findings

    ChartQAPro: A More Diverse and Challenging Benchmark for Chart Question Answering

    Ahmed Masry , Mohammed Saidul Islam , Mahir Ahmed , Aayush Bajaj , Firoz Kabir , Aaryaman Kartha , Md Tahmid Rahman Laskar , Mizanur Rahman , Shadikur Rahman , Mehrad Shahmohammadi , Megh Thakkar , Md Rizwan Parvez , Enamul Hoque and Shafiq Joty
    Findings of the Association for Computational Linguistics: ACL 20252025
  9. CGF Journal

    Natural Language Generation for Visualizations: State of the Art, Challenges and Future Directions

    Enamul Hoque and Mohammed Saidul Islam
    Computer Graphics Forum2025

2024

  1. EMNLP Conference

    DataNarrative: Automated Data-Driven Storytelling with Visualizations and Texts

    Mohammed Saidul Islam , Md Tahmid Rahman Laskar , Md Rizwan Parvez , Enamul Hoque and Shafiq Joty
    Proceedings of the 2024 Conference on Empirical Methods in Natural Language Processing2024
  2. EMNLP Findings

    Are Large Vision Language Models up to the Challenge of Chart Comprehension and Reasoning? An Extensive Investigation into the Capabilities and Limitations of LVLMs

    Mohammed Saidul Islam , Raian Rahman , Ahmed Masry , Md Tahmid Rahman Laskar , Mir Tafseer Nayeem and Enamul Hoque
    Findings of the Association for Computational Linguistics: EMNLP 20242024
  3. LREC-COLING Conference

    BenLLM-Eval: A Comprehensive Evaluation into the Potentials and Pitfalls of Large Language Models on Bengali NLP

    Mohsinul Kabir , Mohammed Saidul Islam , Md Tahmid Rahman Laskar , Mir Tafseer Nayeem , M. Saiful Bari and Enamul Hoque
    Proceedings of the 2024 Joint International Conference on Computational Linguistics, Language Resources and Evaluation2024

2023

  1. Canadian AI Conference

    Multihop Factual Claim Verification Using Natural Language Prompts

    Md Mezbaur Rahman , Mohammed Saidul Islam , Md Tahmid Rahman Laskar , Md Azam Hossain and Abu Raihan Mostofa Kamal
    Proceedings of the Canadian Conference on Artificial Intelligence2023

2022

  1. Sensors Journal

    Explainable Artificial Intelligence Model for Stroke Prediction Using EEG Signal

    Mohammed Saidul Islam , Iqram Hussain , Md Mezbaur Rahman , Se Jin Park and Md Azam Hossain
    Sensors2022
  2. ICECE Conference

    Gender-Based Cyberbullying Detection for Under-Resourced Bangla Language

    Hasnain Karim Rabib , Mostafa Galib , Takia Mosharref Nobo , Tanjila Alam Sathi , Mohammed Saidul Islam , Abu Raihan Mostofa Kamal and Md Azam Hossain
    2022 12th International Conference on Electrical and Computer Engineering2022
  3. ICCIT Conference

    An Efficient Approach to Automatic Tag Prediction from Movie Plot Synopses Using Transformer-Based Language Model

    Md Mezbaur Rahman , Saadman Malik , Mohammed Saidul Islam , Fardin Saad , Md Azam Hossain and Abu Raihan Mostofa Kamal
    2022 25th International Conference on Computer and Information Technology2022
  4. EMNLP Findings

    BanglaRQA: A Benchmark Dataset for Under-Resourced Bangla Language Reading Comprehension-Based Question Answering with Diverse Question-Answer Types

    Syed Mohammed Sartaj Ekram , Adham Arik Rahman , Md. Sajid Altaf , Mohammed Saidul Islam , Mehrab Mustafy Rahman , Md Mezbaur Rahman , Md Azam Hossain and Abu Raihan Mostofa Kamal
    Findings of the Association for Computational Linguistics: EMNLP 20222022

2019

  1. IUT Other

    Improving Deep Learning Based Recommender Systems Using Dimensionality Reduction Methodologies

    Mohammad Anas Jawad and Mohammed Saidul Islam
    2019