igitman's picture
Add model card and Bias/Explainability/Privacy/Safety subcards (MR !102 f73d94f)
0aa1573 verified
|
Raw
History Blame Contribute Delete
960 Bytes
Field Response
Participation considerations from adversely impacted groups protected classes in model design and testing: [None]
Measures taken to mitigate against unwanted bias: Supervised Fine-Tuning (SFT) and Reinforcement Learning from Human Feedback (RLHF) employed to calibrate the model’s reasoning capabilities to maintain logical consistency and appropriate complexity when interacting with or interpreting data from diverse age demographics.
Bias Metric (If Measured): BBQ Accuracy Scores in Ambiguous Contexts . https://github.com/nyu-mll/BBQ/