Harsh Raj
Publications
Resume
Model or Harness? An Interaction-Centric Taxonomy for Localizing Agent Failures
Harsh Raj
, Vipul Gupta, Anas Mahmoud, Razvan-Gabriel Dumitru, Darvin Yi, Aakash Sabharwal, Yunzhong He
Paper
Blog
Scale AI 2026
MixtureVitae: Open Web-Scale Pretraining Dataset With High Quality Instruction and Reasoning Data Built from Permissive-First Text Sources
Huu Nguyen*, Victor May*,
Harsh Raj
*, Marianna Nezhurina, Yishan Wang, ..., Jenia Jitsev
Paper
Code
TMLR (Featured / J2C → ICML) 2026
OpenThoughts-Agent: Data Recipes for Agentic Models
Negin Raoof, Richard Zhuang, Marianna Nezhurina, Etash Guha, ...,
Harsh Raj
, et al.
Paper
Consistency as a Testable Property: Statistical Methods to Evaluate AI Agent Reliability
Harsh Raj
, Niranjan Orkat, Suvrorup Mukherjee, Aritra Guha, Cheryl Flynn, Subhabrata Majumdar
Paper
Improving Consistency in Large Language Models through Chain of Guidance
Harsh Raj
, Vipul Gupta, Domenic Rosati, Subho Majumdar
Paper
Code
TMLR 2025
Mitigating Unsafe Feedback with Learning Constraints
Domenic Rosati, Giles Edkins,
Harsh Raj
, David Atanasov, Subhabrata Majumdar, Janarthanan Rajendran, Frank Rudzicz, Hassan Sajjad
Paper
AAAI 2024
On transfer of adversarial robustness from pretraining to downstream tasks
Laura F. Nern,
Harsh Raj
, Maurice Georgi, Yash Sharma
Paper
Code
NeurIPS 2023
Evaluating the robustness of biomedical concept normalization
Sinchani Chakraborty,
Harsh Raj
, Srishti Gureja, Tanmay Jain, Atif Hassan, Sayantan Basu
Paper
Code
NeurIPS 2023
Measuring reliability of large language models through semantic consistency
Harsh Raj
, Domenic Rosati, Subho Majumdar
Paper
Code
NeurIPS 2023
GANDALF: Gated Adaptive Network for Deep Automated Learning of Features
Manu Joseph,
Harsh Raj
Paper
Code
AskYourDB: An end-to-end system for querying and visualizing relational databases using natural language
Manu Joseph,
Harsh Raj
, Anubhav Yadav, Aaryamann Sharma
Paper