尧图网站设计 尧图网站设计YAOTU DESIGN
ARTICLE DETAIL

资讯详情

深耕网站设计与一线实操的经验洞察。

Exploring the Potential of Large Language Models in Fine-Grained Review Comment Classification

Exploring the Potential of Large Language Models in Fine-Grained Review Comment Classification 文章总结与翻译一、文章主要内容本文聚焦大型语言模型(LLMs)在代码审查评论细粒度分类中的应用潜力,旨在解决传统监督机器学习方法依赖大量人工标注数据、泛化能力有限的问题,具体内容如下:研究背景:代码审查(CR)是软件开发中的关键质量保障环节,但现代轻量级审查中存在20%-44%的“无用”评论,浪费开发者时间。传统方法多将评论分为5个高层类别,且依赖人工标注数据,难以处理17个细粒度类别(部分高价值类别数据占比不足1%)的不平衡问题。研究设计分类策略:对比两种分类策略——“扁平策略”(单步直接分类为17个类别)和“分层策略”(两步分类:先分5个高层组,再分对应子类别)。输入上下文:测试“仅评论”和“代码+评论”两种输入形式,探究代码上下文对分类效果的影响。模型与数据集:选用Qwen 2(7B、72B)和Llama 3(8B、70B、405B)系列模型,基于OpenStack Nova项目的1828条人工标注评论数据集,与现有最优方法(CodeBERT+LSTM)对比。核心结果RQ1(LLMs能否分类评论):LLMs可有效分类17个类别,性能远超随机猜测和多数类基线。其中Llama 3.1-405B采用扁平策略+代码上下
返回列表