AgentBench: Evaluating LLMs as Agents

Xiao Liu, Jie Tang(Tsinghua University), Yu‐Cheng Gu(Syngenta (United Kingdom)), Hanyu Lai(Tongji University), Zhengxiao Du(Beijing Academy of Artificial Intelligence), Minlie Huang(National University of Defense Technology), Yuxiao Dong, Hao Yu, Yifan Xu, Hangliang Ding(Wenzhou Medical University), Chenhui Zhang(Second Hospital of Tianjin Medical University), Sheng Shen(University of California, Berkeley), Huan Sun(St. Jude Children's Research Hospital), Tianjun Zhang, Xuanyu Lei, Kejuan Yang, Yu Su, Xiang Deng, Shudan Zhang, Hanchen Zhang(Chinese Academy of Sciences), Kaiwen Men, Aohan Zeng
arXiv (Cornell University)
August 7, 2023
Cited by 51


Related Papers