AlpacaFarm: A Simulation Framework for Methods that Learn from Human FeedbackYann Dubois, Tatsunori Hashimoto, Ishaan Gulrajani et al.|arXiv (Cornell University)|2023Cited by 55
Learning to (Learn at Test Time): RNNs with Expressive Hidden StatesYu Sun, Carlos Guestrin, Xinhao Li et al.|arXiv (Cornell University)|2024Cited by 14