Okapi: Instruction-tuned Large Language Models in Multiple Languages with Reinforcement Learning from Human Feedback

Viet Dac Lai(Adobe Systems (United States)), Thien Huu Nguyen(University of Oregon), Anh Chien Nguyen(Nanyang Technological University), Thuat Nguyen-Tran, Franck Dernoncourt(Adobe Systems (United States)), Ryan A. Rossi(Adobe Systems (United States)), Nghia Ngo(University of Oregon)
Unknown
January 1, 2023
Cited by 24


Related Papers

The Network Data Repository with Interactive Graph Analytics and Visualization
|Proceedings of the AAAI Conference on Artificial Intelligence|2015|2.5k
Bias and Fairness in Large Language Models: A Survey
|Computational Linguistics|2024|583
Attention Models in Graphs
|ACM Transactions on Knowledge Discovery from Data|2019|242