执行
How Coding Agents Fail Their Users: A Large-Scale Analysis of Developer-Agent Misalignment in 20,574 Real-World Sessions
2026-05-29arxiv.org
★★★★★
基于两万多次真实开发会话数据,量化分析编程智能体的失败模式。
值得记下
阅读原文↗揭示真实场景中开发者意图与智能体执行逻辑的系统性偏差,为产品定义容错机制与交互边界提供实证依据。
内容来源:arxiv.org,版权归原作者所有