跳到正文
arXiv cs.SE· Nishant Balepur, Kiran Tomlinson, Tobias Schnabel·· 2 小时前AI 评分37

CABRA 基准揭示:代码理解才是编程智能体的瓶颈

Code Understanding is a Bottleneck for Coding Agents

AI 导读

研究者提出 CABRA 编程能力评估基准,以调用图变换从零构建任务,并按函数遍历、搜索、运行时解析、指令遵循四个维度用任务规模参数调节难度。

来源:arXiv cs.SE · arxiv.org