Devin的80%时刻:后台智能体如何改写编码
规格足够好时,模型可独立走完改代码到PR,7倍PR和80%自家提交占比是佐证。对团队的用处是:先把需求写清、可测,再谈后台并行;规格不清时仍需人在回路。
2025年12月前后,工程界的用法明显转弯。Opus 4.5、GPT 5.2这类模型到来之后,只要规格说明写得足够好,智能体可以很少打断、直接从说明走到一个完整的拉取请求。此前在集成开发环境里手把手盯着模型的做法,开始被搬到云端的后台智能体取代。 Cognition内部的变化很直观。合并的PR数量在两三个月里增长了7倍,工程人数只增长约10%。Devin在自家仓库的提交占比,1月还是16%,到3月已到80%。往前看,Sonnet 3.7那次跃升时,团队反而拆掉了Devin里很
来源:youtube 原始内容