每条模型原始返回都可公开核验
下载图片(含二维码)分享到 X分享到 LinkedIn

微信:保存图片后在聊天里长按识别二维码。

← 返回本集
AI 编码代理 · 场景榜

边界探针:个人代理运行时(不入网格)

最受欢迎的开源个人AI助理

这是一次边界探针,不是品类榜:问的是自托管的个人代理运行时,与编码代理品类几乎不重叠(与品类总题的实体交叉率中文 0.0%、英文 2.9%)。中文侧完整度 76.7%,读的时候要打折。

定义不稳

在 2026-09-22 的这次测量中 · 12 席模型面板 · 10 个场景 · 方法论 #2 v2026-09-22.1

分享
下载图片(含二维码)分享到 X分享到 LinkedIn

微信:保存图片后在聊天里长按识别二维码。

前十
名次实体提及率(作答数)Wilson 95% 区间提到过的席位稳定覆盖席位
1OpenWebUI65.2%[57.0%, 72.7%]12 / 1210 / 12
2Jan61.6%[53.3%, 69.3%]12 / 1211 / 12
3AnythingLLM56.5%[48.2%, 64.5%]12 / 129 / 12
4GPT4All54.3%[46.0%, 62.4%]12 / 129 / 12
5Ollama49.3%[41.1%, 57.5%]12 / 126 / 12
6PrivateGPT47.8%[39.7%, 56.1%]11 / 126 / 12
7LocalAI46.4%[38.3%, 54.7%]10 / 127 / 12
8Dify44.9%[36.9%, 53.3%]12 / 124 / 12
9LibreChat41.3%[33.4%, 49.6%]12 / 124 / 12
10Khoj39.9%[32.1%, 48.2%]11 / 124 / 12

口径:提及率 = 提到它的作答数 ÷ 138(5 条问法 × 3 次重复 × 12 席 = 180 次,有效 138 次);后两列按席位数算,「稳定覆盖」指该席自己的 12 次里提到过半。两者分母不同,12 / 12 与提及率不到 100% 并不矛盾。

这一格的样本

有效样本 / 应答数
138 / 180
完整度
76.7%
有效实体数 effN
28.0
被提到过的实体
77

这一格是怎么问的

这一格用了 5 条问法,每条各问 3 次;每次只要模型写出前十个名字,不要理由、不要打分。

  1. 最受欢迎的开源个人AI助理
  2. 自己电脑上跑、能接到常用聊天软件里的开源个人 AI 助理有哪些
  3. 想在自己的机器上跑一个 24 小时在线、能帮我处理消息和日常任务的个人 AI 代理,有哪些开源项目
  4. 开源 个人 AI 助理 本地部署
  5. 列举一些可以自托管的开源个人 AI 助理项目

这一页读到哪里为止

  • 这是一次测量,不是趋势线。同一套问法的下一次重测要等下个季度。
  • 每次只收前十个名字。排在十名之外的东西,在这一格里看不见,不等于它不存在。
  • 提及率是模型在这一格里提到某个名字的样本比例,不是市场份额,也不是对产品好坏的判断。
  • 这一格只读谁在场,不读名次。

方法论:面板构成、问法与完整度口径

在 Claude、Cursor 等 agent 里也能查这份数据,返回时附带同一套读法。 Agent 接入 →