{"slug":"waybarrios-trl-training","source_name":"waybarrios/trl-training","name":"Waybarrios/Trl Training","description":"Train and fine-tune transformer language models using TRL (Transformers Reinforcement Learning). Supports SFT, DPO, GRPO, KTO, RLOO and Reward Model training via CLI commands.","version":1,"lift":{"pass_rate_delta_pts":40.91,"pass_rate_pct":90.9,"total_cases":22,"passed_cases":20,"tokens_delta_pct":64.1,"turns_delta_pct":0,"verdict":"mixed","benchmark_model":"gemini-3.6-flash","grading_method":"judged","completed_at":"2026-08-19T06:25:07.107188+00:00"},"skill_score":null,"benchmark_models":[{"model":"gemini-3.6-flash","headline":true,"delta_pts":40.91,"with_pass_pct":90.9,"without_pass_pct":50,"tokens_delta_pct":64.1,"turns_delta_pct":0,"total_cases":22,"cases_aggregated":22,"verdict":"mixed","never_hurt":false,"completed_at":"2026-08-19T06:25:07.107188+00:00","run_id":"4edd8fbb-9ea5-4365-95b6-4cddf33fa266","version_number":1,"is_latest_version":true,"gate":null}],"trust":{"skill_safety":"passed","safety_status":"clean","intent_verdict":"safe","content_status":"clean","indexable":true},"license":"Apache-2.0 (modified; see UPSTREAMS.json)","install_count":0,"manifest_hash":"dc19b92eb502208165c1dacb5d8766c04cf99770931097e43ff240992e823d53","raw_url":"https://app.decimal.ai/s/waybarrios-trl-training/SKILL.md","scorecard_url":"https://app.decimal.ai/skills/waybarrios-trl-training"}