MixtureVitae: Open Web-Scale Pretraining Dataset With High Quality Instruction and Reasoning Data Built from Permissive-First Text Sources
Huu Nguyen*, Victor May*, Harsh Raj*, Marianna Nezhurina, Yishan Wang, ..., Jenia Jitsev


TMLR (Featured / J2C → ICML) 2026
OpenThoughts-Agent: Data Recipes for Agentic Models
Negin Raoof, Richard Zhuang, Marianna Nezhurina, Etash Guha, ..., Harsh Raj, et al.


Consistency as a Testable Property: Statistical Methods to Evaluate AI Agent Reliability
Harsh Raj, Niranjan Orkat, Suvrorup Mukherjee, Aritra Guha, Cheryl Flynn, Subhabrata Majumdar


Improving Consistency in Large Language Models through Chain of Guidance
Harsh Raj, Vipul Gupta, Domenic Rosati, Subho Majumdar


TMLR 2025
Mitigating Unsafe Feedback with Learning Constraints
Domenic Rosati, Giles Edkins, Harsh Raj, David Atanasov, Subhabrata Majumdar, Janarthanan Rajendran, Frank Rudzicz, Hassan Sajjad


AAAI 2024
On transfer of adversarial robustness from pretraining to downstream tasks
Laura F. Nern, Harsh Raj, Maurice Georgi, Yash Sharma


NeurIPS 2023
Evaluating the robustness of biomedical concept normalization
Sinchani Chakraborty, Harsh Raj, Srishti Gureja, Tanmay Jain, Atif Hassan, Sayantan Basu


NeurIPS 2023
Measuring reliability of large language models through semantic consistency
Harsh Raj, Domenic Rosati, Subho Majumdar


NeurIPS 2023
GANDALF: Gated Adaptive Network for Deep Automated Learning of Features
Manu Joseph, Harsh Raj


AskYourDB: An end-to-end system for querying and visualizing relational databases using natural language
Manu Joseph, Harsh Raj, Anubhav Yadav, Aaryamann Sharma