Zhilin Wang

Zhilin Wang on Hugging Face Daily Papers: 7 papers, 0 in the top 3 of their day, 114 upvotes.

  1. ProfBench: Multi-Domain Rubrics requiring Professional Knowledge to Answer and Judge 7 upvotes, #19 of 2025-10-23
  2. RLBFF: Binary Flexible Feedback to bridge between Human Feedback & Verifiable Rewards 3 upvotes, #33 of 2025-09-29
  3. HelpSteer3-Preference: Open Human-Annotated Preference Data across Diverse Tasks and Languages 2 upvotes, #35 of 2025-05-20
  4. Dedicated Feedback and Edit Models Empower Inference-Time Scaling for Open-Ended General-Domain Tasks 6 upvotes, #17 of 2025-03-07
  5. HelpSteer2-Preference: Complementing Ratings with Preferences 7 upvotes, #13 of 2024-10-03
  6. HelpSteer2: Open-source dataset for training top-performing reward models 13 upvotes, #14 of 2024-06-14
  7. NeMo-Aligner: Scalable Toolkit for Efficient Model Alignment 20 upvotes, #5 of 2024-05-03

Data: hysts-bot-data/daily-papers-stats and the Daily Papers API. Open data: tardellirs/paper-pulse-data. Sister project: Model Pulse, the download history of every model on the Hub.