Recommenders, Models & Data · research
riskcal-rlvr
Research code exploring risk-sensitive calibration rewards for RLVR reasoning models.
RI
Repositoryappleweiping/riskcal-rlvr
Statusactive
Demo evidencenone
Last updated2026-06-23
Technology and topics
No public demo is currently available.