Holistic Evaluation of Language ModelsPercy Liang, Yuta Koreeda, Yuhuai Wu et al.|arXiv (Cornell University)|2022Cited by 119
Optimizing generative AI by backpropagating language model feedbackMert Yüksekgönül, James Zou, Federico Bianchi et al.|Nature|2025Cited by 62
TextGrad: Automatic "Differentiation" via TextMert Yüksekgönül, James Zou, Federico Bianchi et al.|arXiv (Cornell University)|2024Cited by 12
Beyond Confidence: Reliable Models Should Also Consider AtypicalityMert Yüksekgönül, Carlos Guestrin, Linjun Zhang et al.|arXiv (Cornell University)|2023Cited by 2