Computer vision & multimodal learning

Daniel Shalam

Building data-efficient multimodal systems that connect research with real-world applications.

I am a Ph.D. candidate in Computer Science at the University of Haifa, advised by Dr. Simon Korman, and an Applied Scientist Intern at Amazon Prime Sports. My research focuses on multimodal alignment, MLLM grounding, and data-efficient computer vision, with recent work spanning image, video, and audio localization.

Selected work

Publications

Research spanning multimodal grounding, encoder alignment, self-supervised learning, and few-shot classification.

Contact

Interested in multimodal learning or computer vision research?

Get in touch