Zhilin Wang
Zhilin Wang on Hugging Face Daily Papers: 7 papers, 0 in the top 3 of their day, 114 upvotes.
- ProfBench: Multi-Domain Rubrics requiring Professional Knowledge to Answer and Judge 7 upvotes, #19 of 2025-10-23
- RLBFF: Binary Flexible Feedback to bridge between Human Feedback & Verifiable Rewards 3 upvotes, #33 of 2025-09-29
- HelpSteer3-Preference: Open Human-Annotated Preference Data across Diverse Tasks and Languages 2 upvotes, #35 of 2025-05-20
- Dedicated Feedback and Edit Models Empower Inference-Time Scaling for Open-Ended General-Domain Tasks 6 upvotes, #17 of 2025-03-07
- HelpSteer2-Preference: Complementing Ratings with Preferences 7 upvotes, #13 of 2024-10-03
- HelpSteer2: Open-source dataset for training top-performing reward models 13 upvotes, #14 of 2024-06-14
- NeMo-Aligner: Scalable Toolkit for Efficient Model Alignment 20 upvotes, #5 of 2024-05-03
Data: hysts-bot-data/daily-papers-stats and the Daily Papers API. Open data: tardellirs/paper-pulse-data. Sister project: Model Pulse, the download history of every model on the Hub.