arXiv cs.SE· Nishant Balepur, Kiran Tomlinson, Tobias Schnabel·· 2 小时前AI 评分37
CABRA 基准揭示:代码理解才是编程智能体的瓶颈
Code Understanding is a Bottleneck for Coding Agents
AI 导读
研究者提出 CABRA 编程能力评估基准,以调用图变换从零构建任务,并按函数遍历、搜索、运行时解析、指令遵循四个维度用任务规模参数调节难度。
来源:arXiv cs.SE · arxiv.org