Xiaoming
zzwang-se-cuhk
·
AI & ML interests
None yet
Recent Activity
upvoted a paper about 19 hours ago
LEGO-RL: Harness-Native Reinforcement Learning for Coding Agents upvoted a paper over 1 year ago
What, How, Where, and How Well? A Survey on Test-Time Scaling in Large
Language Models upvoted an article over 1 year ago
Mini-R1: Reproduce Deepseek R1 „aha moment“ a RL tutorialOrganizations
None yet