arxiv:2412.03679
Vijay Viswanathan
viswavi
AI & ML interests
Natural Language Processing, Synthetic Data, Data Mining, Human-Centered AI
Recent Activity
upvoted a paper about 1 month ago
DRACO: Fine-Grained Credit Assignment with Dynamic Rubrics for Long-Horizon Agent Training published a dataset 3 months ago
viswavi/Possible-Impossible-LCB submitted a paper 3 months ago
Discretizing Reward Models