Training language models to follow instructions with human feedbackLong Ouyang, Ryan Lowe, Carroll L. Wainwright et al.|arXiv (Cornell University)|2022Cited by 4.3k
Evaluating Large Language Models Trained on CodeMark Chen, Miles Brundage, Jerry Tworek et al.|arXiv (Cornell University)|2021Cited by 1.5k