Automating dataset updates towards reliable and timely evaluation of Large Language Models
Large language models (LLMs) have achieved impressive performance across various natural language benchmarks, prompting a continual need to curate more difficult datasets for larger LLMs, which is costly and time-consuming. In this paper, we propose to automate dataset updating and provide systemati...
محفوظ في:
المؤلفون الرئيسيون: | YING, Jiahao, CAO, Yixin, BAI, Yushi, SUN, Qianru, WANG, Bo, TANG, Wei, DING, Zhaojun, YANG, Yizhe, HUANG, Xuanjing, YAN, Shuicheng |
---|---|
التنسيق: | text |
اللغة: | English |
منشور في: |
Institutional Knowledge at Singapore Management University
2024
|
الموضوعات: | |
الوصول للمادة أونلاين: | https://ink.library.smu.edu.sg/sis_research/9439 |
الوسوم: |
إضافة وسم
لا توجد وسوم, كن أول من يضع وسما على هذه التسجيلة!
|
المؤسسة: | Singapore Management University |
اللغة: | English |
مواد مشابهة
-
Eigenvalues and switching algorithms for Quasi-Newton updates
بواسطة: Phua, P.K.H.
منشور في: (2014) -
LLMs-as-instructors : Learning from errors toward automating model improvement
بواسطة: YING, Jiahao, وآخرون
منشور في: (2024) -
We challenge you to certify your updates
بواسطة: Chen, S., وآخرون
منشور في: (2013) -
View update in entity-relationship approach
بواسطة: Ling, T.W., وآخرون
منشور في: (2014) -
Combating obsolescence: Predictors of technical updating among engineers
بواسطة: Aryee, S.
منشور في: (2013)