We introduce VectorGym, a new comprehensive multi-task benchmark for evaluating Vision-Language Models (VLMs) on Scalable Vector …
Juan A. Rodriguez,
Haotian Zhang, Abhay Puri,
Tianyang Zhang,
Rishav Pramanik,
Meng Lin,
Xiaoqing Xie,
Marco Terral,
Darsh Kaushik,
Aly Shariff,
Perouz Taslakian, Spandana Gella,
Sai Rajeswar Mudumba,
David Vazquez, Christopher Pal,
Marco Pedersoli
Conference on Empirical Methods in Natural Language Processing (EMNLP),
2026.
Recent progress in large language models (LLMs) has focused on producing responses that meet human expectations and align with shared …
Karolina Stanczak,
Nicholas Meade,
Mehar Bhatia,
Hattie Zhou,
Konstantin Böttinger,
Jeremy Barns, Jason Stanley,
Nicolas Papernot,
Nicolas Chapados,
Denis Therien,
Timothy P Lillicrap,
Ana Marasovic,
Sylvie Delacroix,
Gillian K Hadfield, Siva Reddy
ACM Conference on Fairness, Accountability, and Transparency,
2026.