研究发现:自主编程代理忽视开源贡献准则
北京大学的一项新研究表明,自主编程代理在参与开源项目时往往忽略了项目的贡献规则。研究团队对四个前沿模型进行了实验,从49个包含AI贡献准则的仓库中整理了106个问题,并根据每个仓库的规定评估每项任务的表现。结果显示,这些代理很少主动检索贡献规则,在经过提示、引用政策和验证反馈后,虽然在披露和验证方面有所改进,但它们从未拒绝向禁止AI生成提交的仓库作出贡献。研究者指出,当前编程代理面临一个伦理困境:当用户要求执行与项目规定相冲突的任务时,如何平衡用户的请求和项目的规则?例如,在明确禁止全自动化或主要由AI生成代码提交的项目中,代理应该如何处理这样的任务?
