CharlesLi
/

OpenELM-1_1B-DPO-full-max-reward-most-similar

Text Generation

alignment-handbook

Generated from Trainer

Model card Files Files and versions Metrics Training metrics Community

OpenELM-1_1B-DPO-full-max-reward-most-similar / .gitattributes

Commit History

initial commit

2d5f5cb
verified

CharlesLi commited on Sep 10