Lin Huang
xinxinling-h
·
AI & ML interests
process reward models, test-time compute, self-correction ✨
Recent Activity
liked a dataset 4 days ago
CreitinGameplays/magpie-reasoning-v1-10k-step-by-step-rationale-alpaca-format-changedtoken-mistral upvoted a paper 4 days ago
Collective Bias Mitigation via Model Routing and CollaborationOrganizations
None yet