|
Uncovering Grounding IDs: How External Cues Shape Multi-Modal Binding
Hosein Hasani*, Amirmohammad Izadi*, Fatemeh Askari*, Mobin Bagherian*,
Sadegh Mohammadian*, Mohammad Izadi, Mahdieh Soleymani Baghshah
ICML, 2026
arXiv / code
|
|
Understanding Counting Mechanisms in Large Language and Vision-Language Models
Hosein Hasani*, Amirmohammad Izadi*, Fatemeh Askari*, Mobin Bagherian,
Sadegh Mohammadian, Mohammad Izadi, Mahdieh Soleymani Baghshah
CVPR, 2026
arXiv / code
|
|
Mechanistic Interpretability of Large-Scale Counting in LLMs through a System-2 Strategy
Hosein Hasani, Mohammadali Banayeeanzade, Ali Nafisi, Sadegh Mohammadian,
Fatemeh Askari, Mobin Bagherian, Amirmohammad Izadi, Mahdieh Soleymani Baghshah
Findings of ACL, 2026
arXiv /
|
|
EYE-Q: A Multilingual Benchmark for Visual Word Puzzle Solving and Image-to-Phrase Reasoning
Ali Najar, Alireza Mirrokni, Arshia Izadyari*, Sadegh Mohammadian*, Amir Homayoon Sharifizade*, Asal Meskin*, Mobin Bagherian*, Ehsaneddin Asgari
Under Review, 2026
arXiv / code / dataset
|
|
NeuroAI Lab
Vision Language Models • Jul. 2026 to Now
Advisor: Prof. Martin Schrimpf
|
|
|
QCRI LLM Lab
Vision Language Models • Nov. 2025 to Now
Advisor: Prof. Ehsaneddin Asgari
|
|
|
Sharif ML Lab
Vision Language Models • Apr. 2025 to Now
Advisor: Prof. Mahdieh Soleymani
|
|
|