亲爱的研友该休息了!由于当前在线用户较少,发布求助请尽量完整的填写文献信息,科研通机器人24小时在线,伴您度过漫漫科研夜!身体可是革命的本钱,早点休息,好梦!

Large Language Models in Fault Localisation

调试 背景(考古学) 计算机科学 断层(地质) 一致性(知识库) 公制(单位) 事件(粒子物理) 编码(集合论) 故障注入 故障覆盖率 可靠性工程 软件 人工智能 工程类 程序设计语言 运营管理 地理 电子线路 物理 电气工程 考古 集合(抽象数据类型) 量子力学 地震学 地质学
作者
Yonghao Wu,Zheng Li,Jie M. Zhang,Mike Papadakis,Mark Harman,Yongxin Liu
出处
期刊:Cornell University - arXiv 被引量:6
标识
DOI:10.48550/arxiv.2308.15276
摘要

Large Language Models (LLMs) have shown promise in multiple software engineering tasks including code generation, program repair, code summarisation, and test generation. Fault localisation is instrumental in enabling automated debugging and repair of programs and was prominently featured as a highlight during the launch event of ChatGPT-4. Nevertheless, the performance of LLMs compared to state-of-the-art methods, as well as the impact of prompt design and context length on their efficacy, remains unclear. To fill this gap, this paper presents an in-depth investigation into the capability of ChatGPT-3.5 and ChatGPT-4, the two state-of-the-art LLMs, on fault localisation. Using the widely-adopted large-scale Defects4J dataset, we compare the two LLMs with the existing fault localisation techniques. We also investigate the consistency of LLMs in fault localisation, as well as how prompt engineering and the length of code context affect the fault localisation effectiveness. Our findings demonstrate that within function-level context, ChatGPT-4 outperforms all the existing fault localisation methods. Additional error logs can further improve ChatGPT models' localisation accuracy and consistency, with an average 46.9% higher accuracy over the state-of-the-art baseline SmartFL on the Defects4J dataset in terms of TOP-1 metric. However, when the code context of the Defects4J dataset expands to the class-level, ChatGPT-4's performance suffers a significant drop, with 49.9% lower accuracy than SmartFL under TOP-1 metric. These observations indicate that although ChatGPT can effectively localise faults under specific conditions, limitations are evident. Further research is needed to fully harness the potential of LLMs like ChatGPT for practical fault localisation applications.
最长约 10秒,即可获得该文献文件

科研通智能强力驱动
Strongly Powered by AbleSci AI
更新
大幅提高文件上传限制,最高150M (2024-4-1)

科研通是完全免费的文献互助平台,具备全网最快的应助速度,最高的求助完成率。 对每一个文献求助,科研通都将尽心尽力,给求助人一个满意的交代。
实时播报
ktw完成签到,获得积分10
13秒前
hahahan完成签到 ,获得积分10
49秒前
跳跃的谷雪完成签到 ,获得积分10
1分钟前
9527z完成签到,获得积分10
2分钟前
LouieHuang完成签到,获得积分10
2分钟前
招水若离完成签到,获得积分10
2分钟前
可爱的函函应助奋斗的杰采纳,获得10
3分钟前
lkk183完成签到 ,获得积分10
3分钟前
4分钟前
yaoyao发布了新的文献求助10
4分钟前
4分钟前
奋斗的杰发布了新的文献求助10
4分钟前
科研通AI2S应助奋斗的杰采纳,获得10
5分钟前
CC完成签到 ,获得积分10
6分钟前
6分钟前
Nancy0818完成签到 ,获得积分10
6分钟前
不去明知山完成签到 ,获得积分10
6分钟前
kitty完成签到,获得积分10
7分钟前
feiCheung完成签到 ,获得积分10
7分钟前
矮小的觅云完成签到 ,获得积分10
7分钟前
红油曲奇完成签到,获得积分10
8分钟前
8分钟前
鹤鸣发布了新的文献求助10
8分钟前
鹤鸣完成签到,获得积分10
8分钟前
jyy应助科研通管家采纳,获得10
11分钟前
阿泽完成签到 ,获得积分10
11分钟前
11分钟前
11分钟前
12分钟前
东溟渔夫发布了新的文献求助10
12分钟前
nefu biology完成签到,获得积分20
12分钟前
东溟渔夫完成签到,获得积分10
12分钟前
drs完成签到,获得积分10
12分钟前
陈一一完成签到 ,获得积分10
12分钟前
Otter完成签到,获得积分10
13分钟前
jyy应助科研通管家采纳,获得10
13分钟前
见鹰完成签到,获得积分10
14分钟前
见鹰发布了新的文献求助20
14分钟前
15分钟前
汉堡包应助liubo采纳,获得10
15分钟前
高分求助中
Evolution 10000
ISSN 2159-8274 EISSN 2159-8290 1000
Becoming: An Introduction to Jung's Concept of Individuation 600
Ore genesis in the Zambian Copperbelt with particular reference to the northern sector of the Chambishi basin 500
A new species of Coccus (Homoptera: Coccoidea) from Malawi 500
A new species of Velataspis (Hemiptera Coccoidea Diaspididae) from tea in Assam 500
PraxisRatgeber: Mantiden: Faszinierende Lauerjäger 500
热门求助领域 (近24小时)
化学 医学 生物 材料科学 工程类 有机化学 生物化学 物理 内科学 纳米技术 计算机科学 化学工程 复合材料 基因 遗传学 催化作用 物理化学 免疫学 量子力学 细胞生物学
热门帖子
关注 科研通微信公众号,转发送积分 3162323
求助须知:如何正确求助?哪些是违规求助? 2813330
关于积分的说明 7899698
捐赠科研通 2472835
什么是DOI,文献DOI怎么找? 1316528
科研通“疑难数据库(出版商)”最低求助积分说明 631365
版权声明 602142