执行

How Coding Agents Fail Their Users: A Large-Scale Analysis of Developer-Agent Misalignment in 20,574 Real-World Sessions

2026-05-29arxiv.org

基于两万多次真实开发会话数据,量化分析编程智能体的失败模式。

值得记下

揭示真实场景中开发者意图与智能体执行逻辑的系统性偏差,为产品定义容错机制与交互边界提供实证依据。

阅读原文

内容来源:arxiv.org,版权归原作者所有