Siva Reddy
Research Scientist
AI Research Partnerships & Ecosystem
Siva Reddy is Assistant Professor in the School of Computer Science and the Department of Linguistics at McGill University, a member of Mila, and a Research Scientist at ServiceNow AI Research. His area of research is Natural Language Processing, and his research goal is to enable machines with language understanding abilities such that conversing with them feel as natural as conversing with humans. Along this process, Siva hopes to discover fundamental representations of language, both symbolic and distributional, that allow us to study the connection between language and meaning. His expertise includes building symbolic and deep learning models for language understanding. He works on problems such as semantic parsing, question answering, reading comprehension and conversational systems.
Intérêts
- Natural Language Processing
- Retrieval
- Dialog
- Natural Language Understanding
- Trustworthiness
- Large Language Models
- Human Machine Interaction Through Language
- Multi-lingual
- Semantic Parsing
Publications
WebArena-Pro: A Heterogeneous, Multimodal, Reproducible Benchmark for Web Agents.
Imene Kerboua,
Fatemeh Pesaran,
Xing Han Lu,
Weijian Qi,
Alexander Miller,
Junyi Song,
Yunjia Tian,
Dongjin Kang,
Seyeon Choi,
Marzia Nouri,
Ewen Gueguen,
Matteo Boglioni,
Fengyuan Liu,
Zeyi Liao,
Mengqi Yuan,
Yue Li,
Alexandre Lacoste,
Alexandre Drouin,
Spandana Gella,
Huan Sun,
Gunhee Kim,
Siva Reddy. At
Workshop at the International Conference of Machine Learning (ICML),
2026.
Societal Alignment Frameworks Can Improve LLM Alignment.
Karolina Stanczak,
Nicholas Meade,
Mehar Bhatia,
Hattie Zhou,
Konstantin Böttinger,
Jeremy Barns,
Jason Stanley,
Nicolas Papernot,
Nicolas Chapados,
Denis Therien,
Timothy P Lillicrap,
Ana Marasovic,
Sylvie Delacroix,
Gillian K Hadfield,
Siva Reddy. At
ACM Conference on Fairness, Accountability, and Transparency,
2026.
The Promise of RL for Autoregressive Image Editing.
Saba Ahmadi,
Rabiul Awal,
Ankur Sikarwar,
Amirhossein Kazemnejad,
Ge Ya Luo,
Juan A. Rodriguez,
Sai Rajeswar Mudumba,
Siva Reddy,
Christopher Pal,
Benno Krojer,
Aishwarya Agrawal. At
Neural Information Processing Systems (NeurIPS),
2025.
WebMMU: A Benchmark for Multimodal Multilingual Website Understanding and Code Generation.
Rabiul Awal,
Mahsa Massoud,
Zichao Li,
Aarash Feizi,
Suyuchen Wang,
Christopher Pal,
Aishwarya Agrawal,
David Vazquez,
Siva Reddy,
Juan A. Rodriguez,
Perouz Taslakian,
Sai Rajeswar Mudumba. At
Workshop at the Computer Vision and Pattern Recognition Conference (CVPR),
2025.
Societal Alignment Frameworks Can Improve LLM Alignment.
Karolina Stanczak,
Nicholas Meade,
Mehar Bhatia,
Hattie Zhou,
Konstantin Böttinger,
Jeremy Barns,
Jason Stanley,
Nicolas Papernot,
Nicolas Chapados,
Denis Therien,
Timothy P Lillicrap,
Ana Marasovic,
Sylvie Delacroix,
Gillian K Hadfield,
Siva Reddy. At
Workshop at the International Conference of Learning Representation (ICLR),
2025.
WebMMU: A Benchmark for Multimodal Multilingual Website Understanding and Code Generation.
Rabiul Awal,
Mahsa Massoud,
Zichao Li,
Aarash Feizi,
Suyuchen Wang,
Christopher Pal,
Aishwarya Agrawal,
David Vazquez,
Siva Reddy,
Juan A. Rodriguez,
Perouz Taslakian,
Spandana Gella,
Sai Rajeswar Mudumba. At
Workshop at the International Conference of Learning Representation (ICLR),
2025.
BigDocs: An Open and Permissively-Licensed Dataset for Training Multimodal Models on Document and Code Tasks.
Juan A. Rodriguez,
Xiangru Jian,
Siba Smarak Panigrahi,
Tianyu Zhang,
Aarash Feizi,
Abhay Puri,
Akshay Kalkunte,
Francois Savard,
Ahmed Masry,
Shravan Nayak,
Rabiul Awal,
Mahsa Massoud,
Amirhossein Abaskohi,
Zichao Li,
Suyuchen Wang,
Pierre-André Noël,
Mats L. Richter,
Saverio Vadacchino,
Shubham Agarwal,
Sanket Biswas,
Sara Shanian,
Ying Zhang,
Sathwik Tejaswi Madhusudhan,
João Monteiro,
Krishnamurthy (Dj) Dvijotham,
Torsten Scholak,
Nicolas Chapados,
Sepideh Kharaghani,
Sean Hughes,
Tamer Özsu,
Siva Reddy,
Marco Pedersoli,
Yoshua Bengio,
Christopher Pal,
Issam H. Laradji,
Spandana Gella,
Perouz Taslakian,
David Vazquez,
Sai Rajeswar Mudumba. At
International Conference of Learning Representations (ICLR),
2025.
MMTEB: Massive Multilingual Text Embedding Benchmark.
Kenneth Enevoldsen,
Isaac Chung,
Imene Kerboua,
Márton Kardos,
Ashwin Mathur,
David Stap,
Jay Gala,
Wissam Siblini,
Dominik Krzeminski,
Genta Indra Winata,
Saba Sturua,
Saiteja Utpala,
Mathieu Ciancone,
Marion Schaeffer,
Gabriel Sequeira,
Diganta Misra,
Shreeya Dhakal,
Jonathan Rystrøm,
Roman Solomatin,
Ömer Çagatan,
Akash Kundu,
Martin Bernstorff,
Shitao Xiao,
Akshita Sukhlecha,
Bhavish Pahwa,
Rafał Poswiata,
Kranthi Kiran GV,
Shawon Ashraf,
Daniel Auras,
Björn Plüster,
Jan Philipp Harries,
Loïc Magne,
Isabelle Mohr,
Mariya Hendriksen,
Dawei Zhu,
Hippolyte Gisserot-Boukhlef,
Tom Aarsen,
Jan Kostkan,
Konrad Wojtasik,
Taemin Lee,
Marek Šuppa,
Crystina Zhang,
Roberta Rocca,
Mohammed Hamdy,
Andrianos Michail,
John Yang,
Manuel Faysse,
Aleksei Vatolin,
Nandan Thakur,
Manan Dey,
Dipam Vasani,
Pranjal Chitale,
Simone Tedeschi,
Nguyen Tai,
Artem Snegirev,
Michael Günther,
Mengzhou Xia,
Weijia Shi,
Xing Han Lu,
Jordan Clive,
Gayatri Krishnakumar,
Anna Maksimova,
Silvan Wehrli,
Maria Tikhonova,
Henil Pancha,
Aleksandr Abramov,
Malte Ostendorff,
Zheng Liu,
Simon Clematide,
Lester James Miranda,
Alena Fenogenova,
Guangyu Song,
Ruqiya Bin Saf,
Wen-Ding Li,
Alessia Borghini,
Federico Cassano,
Hongjin Su,
Jimmy Lin,
Howard Yen,
Lasse Hansen,
Sara Hooker,
Chenghao Xiao,
Vaibhav Adlakha,
Orion Weller,
Siva Reddy,
Niklas Muennighoff. At
International Conference of Learning Representations (ICLR),
2025.
The BrowserGym Ecosystem for Web Agent Research.
Thibault Le Sellier De Chezelles,
Maxime Gasse,
Alexandre Drouin,
Massimo Caccia,
Léo Boisvert,
Megh Thakkar,
Tom Marty,
Rim Assouel,
Sahar Omidi Shayegan,
Siva Reddy,
Quentin Cappart,
Graham Neubig,
Nicolas Chapados,
Alexandre Lacoste. At
Transactions on Machine Learning Research (TMLR),
2025.
StarCoder: may the source be with you!.
Raymond Li,
Loubna Ben Allal,
Yangtian Zi,
Denis Kocetkov,
Chenghao Mou,
Christopher Akiki,
Jia Li,
Jenny Chim,
Terry Yue Zhuo,
Thomas Wang,
Mishig Davaadorj,
João Monteiro,
Oleh Shliazhko,
Nicolas Gontier,
Nicholas Meade,
Ming-Ho Yee,
Logesh Kumar Umapathi,
Benjamin Lipkin,
Zhiruo Wang,
Rudra Murthy,
Jason Stillerman,
Siva Sankalp Patel,
Dmitry Abulkhanov,
Marco Zocca,
Zhihan Zhang,
Nour Fahmy,
Urvashi Bhattacharyya,
Swayam Singh,
Sasha Luccioni,
Paulo Villegas,
Maxim Kunakov,
Fedor Zhdanov,
Manuel Romero,
Tony Lee,
Nadav Timor,
Jennifer Ding,
Claire Schlesinger,
Hailey Schoelkopf,
Jan Ebert,
Jennifer Robinson,
Carolyn Jane Anderson,
Brendan Dolan-Gavitt,
Danish Contractor,
Siva Reddy,
Daniel Fried,
Dzmitry Bahdanau,
Yacine Jernite,
Carlos Muñoz Ferrandis,
Sean Hughes,
Thomas Wolf ,
Arjun Guha,
Leandro von Werra,
Harm de Vries,
Joel Lamy Poirier,
Alex Gu,
Armel Zebaze,
Jian Zhu,
Manan Dey,
Marc Marone,
Mayank Mishra,
Muhtasham Oblokulov,
Olivier Dehaene,
Qian Liu,
Tri Dao,
Wenhao Yu,
Niklas Muennighoff. At
Transactions on Machine Learning Research (TMLR),
2023.