2026/04/01 07:09Hugging Face Releases TRL v1.0: A Unified Post-Training Stack for SFT, Reward Modeling, DPO, and GRPO Workflowsvia MarkTechPost (author: Michal Sutter)