每条模型原始返回都可公开核验
下载图片(含二维码)分享到 X分享到 LinkedIn

微信:保存图片后在聊天里长按识别二维码。

← 返回本集
AI 编码代理 · 场景榜

云端异步 / 委托出 PR

最受欢迎的云端异步AI编程代理

中等

在 2026-09-22 的这次测量中 · 12 席模型面板 · 10 个场景 · 方法论 #2 v2026-09-22.1

分享
下载图片(含二维码)分享到 X分享到 LinkedIn

微信:保存图片后在聊天里长按识别二维码。

前十
名次实体提及率(作答数)Wilson 95% 区间提到过的席位稳定覆盖席位
1Devin90.6%[85.3%, 94.2%]12 / 1212 / 12
2Cursor88.9%[83.3%, 92.8%]12 / 1211 / 12
3GitHub Copilot84.8%[78.7%, 89.4%]12 / 1211 / 12
4Replit70.2%[62.9%, 76.5%]12 / 129 / 12
5Windsurf(Devin Desktop)58.5%[51.0%, 65.6%]12 / 128 / 12
6Amazon Q Developer52.0%[44.6%, 59.4%]12 / 126 / 12
7Codex50.9%[43.4%, 58.3%]10 / 125 / 12
8Jules46.8%[39.5%, 54.3%]10 / 125 / 12
9Sweep46.2%[38.9%, 53.7%]11 / 127 / 12
10Factory Droid43.9%[36.6%, 51.4%]9 / 127 / 12

口径:提及率 = 提到它的作答数 ÷ 171(5 条问法 × 3 次重复 × 12 席 = 180 次,有效 171 次);后两列按席位数算,「稳定覆盖」指该席自己的 14 次里提到过半。两者分母不同,12 / 12 与提及率不到 100% 并不矛盾。

这一格的样本

有效样本 / 应答数
171 / 180
完整度
95.0%
有效实体数 effN
20.2
被提到过的实体
92

这一格是怎么问的

这一格用了 5 条问法,每条各问 3 次;每次只要模型写出前十个名字,不要理由、不要打分。

  1. 最受欢迎的云端异步AI编程代理
  2. 把一个 issue 直接丢给 AI,让它在云端改完给我提 PR,有哪些服务
  3. 我们想把一些小需求交给云端的 AI 代理后台跑,回头直接审 PR,有哪些产品能做到
  4. 云端 AI 编程代理 自动提 PR
  5. 列举一些在云端异步执行任务并返回代码变更的 AI 编程代理

这一页读到哪里为止

  • 这是一次测量,不是趋势线。同一套问法的下一次重测要等下个季度。
  • 每次只收前十个名字。排在十名之外的东西,在这一格里看不见,不等于它不存在。
  • 提及率是模型在这一格里提到某个名字的样本比例,不是市场份额,也不是对产品好坏的判断。

方法论:面板构成、问法与完整度口径

在 Claude、Cursor 等 agent 里也能查这份数据,返回时附带同一套读法。 Agent 接入 →