每条模型原始返回都可公开核验
下载图片(含二维码)分享到 X分享到 LinkedIn

微信:保存图片后在聊天里长按识别二维码。

← AI 可见度监测

AI 可见度监测 · 样例报告

两份样例报告

两份样例都用真实数据生成,不是截图,也没有编造任何数字。不用留邮箱。

样例一

名次监测

这一份由我们已经公开的每周监测数据现场生成。6 道周线题(宠物品类,中文问一遍、英文问一遍),每期每个模型问一次。

数据截至 2026-09-27 · 共 5 期 · 面板 12 个模型

各题名次与模型覆盖

图 1最受欢迎的宠物智能喂食器品牌中文提问
  • 小佩
  • PETLIBRO
  • 小米
  • CATLINK
  • PetSafe
  • 95% 区间
  • 竖线 = 面板或方法论变更,两侧不直接比较

数据:第 17、44、134、140、153 期公开榜单 · 可在 /rankings/15 核对

本图基于 12 个模型对 1 道问题(中文提问)的回答,每期每个模型问 1 次。采集时间 2026-08-24 至 2026-09-27,共 5 期;每期有效模型 11–12 个。区间为 95% Wilson 区间。逐期指数与问题原文可在 /rankings/15 查看。 2026-09-27 起有一次变更(换席 · 计分或方法论变更);此后的期次与之前的不直接比较。

表格视图
品牌08-24 #1709-02 #4409-13 #13409-20 #14009-27 #153相邻期判定
小佩#1 · 11/11 · 74%–100%#1 · 11/12 · 65%–99%#1 · 11/11 · 74%–100%#1 · 11/11 · 74%–100%#1 · 12/12 · 76%–100%09-02→09-13 无显著变化 (z=0.98); 09-13→09-20 无显著变化 (z=0.00)
PETLIBRO#3 · 9/11 · 52%–95%#2 · 8/12 · 39%–86%#2 · 9/11 · 52%–95%#2 · 10/11 · 62%–98%#2 · 9/12 · 47%–91%09-02→09-13 无显著变化 (z=0.83); 09-13→09-20 无显著变化 (z=0.62)
小米#2 · 10/11 · 62%–98%#3 · 10/12 · 55%–95%#3 · 9/11 · 52%–95%#7 · 7/11 · 35%–85%#3 · 10/12 · 55%–95%09-02→09-13 无显著变化 (z=-0.10); 09-13→09-20 无显著变化 (z=-0.96)
CATLINK#4 · 8/11 · 43%–90%#8 · 4/12 · 14%–61%#6 · 6/11 · 28%–79%#6 · 5/11 · 21%–72%#4 · 9/12 · 47%–91%09-02→09-13 无显著变化 (z=1.03); 09-13→09-20 无显著变化 (z=-0.43)
PetSafe#5 · 7/11 · 35%–85%#4 · 10/12 · 55%–95%#4 · 9/11 · 52%–95%#4 · 9/11 · 52%–95%#5 · 9/12 · 47%–91%09-02→09-13 无显著变化 (z=-0.10); 09-13→09-20 无显著变化 (z=0.00)
图 2宠物智能喂食器/饮水机英文提问
  • PETLIBRO
  • PetSafe
  • WOPET
  • 小佩
  • Sure Petcare
  • 95% 区间
  • 竖线 = 面板或方法论变更,两侧不直接比较

数据:第 50、135、141、154 期公开榜单 · 可在 /rankings/42 核对

本图基于 12 个模型对 1 道问题(英文提问)的回答,每期每个模型问 1 次。采集时间 2026-09-02 至 2026-09-27,共 4 期;每期有效模型 10–12 个。区间为 95% Wilson 区间。逐期指数与问题原文可在 /rankings/42 查看。 2026-09-27 起有一次变更(换席 · 计分或方法论变更);此后的期次与之前的不直接比较。

表格视图
品牌09-02 #5009-13 #13509-20 #14109-27 #154相邻期判定
PETLIBRO#1 · 11/12 · 65%–99%#1 · 11/11 · 74%–100%#2 · 9/10 · 60%–98%#1 · 12/12 · 76%–100%09-02→09-13 无显著变化 (z=0.98); 09-13→09-20 无显著变化 (z=-1.07)
PetSafe#2 · 11/12 · 65%–99%#3 · 11/11 · 74%–100%#1 · 10/10 · 72%–100%#2 · 12/12 · 76%–100%09-02→09-13 无显著变化 (z=0.98); 09-13→09-20 无显著变化 (z=0.00)
WOPET#3 · 12/12 · 76%–100%#4 · 10/11 · 62%–98%#3 · 10/10 · 72%–100%#3 · 11/12 · 65%–99%09-02→09-13 无显著变化 (z=-1.07); 09-13→09-20 无显著变化 (z=0.98)
小佩#4 · 11/12 · 65%–99%#2 · 10/11 · 62%–98%#4 · 9/10 · 60%–98%#4 · 10/12 · 55%–95%09-02→09-13 无显著变化 (z=-0.06); 09-13→09-20 无显著变化 (z=-0.07)
Sure Petcare#5 · 11/12 · 65%–99%#5 · 11/11 · 74%–100%#5 · 9/10 · 60%–98%#5 · 10/12 · 55%–95%09-02→09-13 无显著变化 (z=0.98); 09-13→09-20 无显著变化 (z=-1.07)
图 3智能猫砂盆中文提问
  • 小佩
  • Litter-Robot
  • CATLINK
  • PetSafe
  • 霍曼
  • 95% 区间
  • 竖线 = 面板或方法论变更,两侧不直接比较

数据:第 46、136、142、155 期公开榜单 · 可在 /rankings/43 核对

本图基于 12 个模型对 1 道问题(中文提问)的回答,每期每个模型问 1 次。采集时间 2026-09-02 至 2026-09-27,共 4 期;每期有效模型 11–12 个。区间为 95% Wilson 区间。逐期指数与问题原文可在 /rankings/43 查看。 2026-09-27 起有一次变更(换席 · 计分或方法论变更);此后的期次与之前的不直接比较。

表格视图
品牌09-02 #4609-13 #13609-20 #14209-27 #155相邻期判定
小佩#1 · 12/12 · 76%–100%#1 · 11/11 · 74%–100%#1 · 11/11 · 74%–100%#1 · 11/12 · 65%–99%09-02→09-13 无显著变化 (z=0.00); 09-13→09-20 无显著变化 (z=0.00)
Litter-Robot#2 · 11/12 · 65%–99%#2 · 11/11 · 74%–100%#3 · 10/11 · 62%–98%#2 · 11/12 · 65%–99%09-02→09-13 无显著变化 (z=0.98); 09-13→09-20 无显著变化 (z=-1.02)
CATLINK#3 · 10/12 · 55%–95%#3 · 10/11 · 62%–98%#2 · 11/11 · 74%–100%#3 · 12/12 · 76%–100%09-02→09-13 无显著变化 (z=0.54); 09-13→09-20 无显著变化 (z=1.02)
PetSafe#4 · 9/12 · 47%–91%#6 · 8/11 · 43%–90%#4 · 9/11 · 52%–95%#4 · 11/12 · 65%–99%09-02→09-13 无显著变化 (z=-0.12); 09-13→09-20 无显著变化 (z=0.51)
霍曼#6 · 6/12 · 25%–75%#5 · 7/11 · 35%–85%#7 · 6/11 · 28%–79%#5 · 9/12 · 47%–91%09-02→09-13 无显著变化 (z=0.66); 09-13→09-20 无显著变化 (z=-0.43)
图 4智能猫砂盆英文提问
  • Litter-Robot
  • 小佩
  • CATLINK
  • PetSafe
  • 尼卡萨
  • 95% 区间
  • 竖线 = 面板或方法论变更,两侧不直接比较

数据:第 47、137、143、156 期公开榜单 · 可在 /rankings/44 核对

本图基于 12 个模型对 1 道问题(英文提问)的回答,每期每个模型问 1 次。采集时间 2026-09-02 至 2026-09-27,共 4 期;每期有效模型 11–12 个。区间为 95% Wilson 区间。逐期指数与问题原文可在 /rankings/44 查看。 2026-09-27 起有一次变更(换席 · 计分或方法论变更);此后的期次与之前的不直接比较。

表格视图
品牌09-02 #4709-13 #13709-20 #14309-27 #156相邻期判定
Litter-Robot#1 · 11/11 · 74%–100%#1 · 11/11 · 74%–100%#1 · 10/11 · 62%–98%#1 · 12/12 · 76%–100%09-02→09-13 无显著变化 (z=0.00); 09-13→09-20 无显著变化 (z=-1.02)
小佩#2 · 11/11 · 74%–100%#2 · 11/11 · 74%–100%#2 · 10/11 · 62%–98%#2 · 12/12 · 76%–100%09-02→09-13 无显著变化 (z=0.00); 09-13→09-20 无显著变化 (z=-1.02)
CATLINK#3 · 10/11 · 62%–98%#3 · 9/11 · 52%–95%#3 · 8/11 · 43%–90%#3 · 12/12 · 76%–100%09-02→09-13 无显著变化 (z=-0.62); 09-13→09-20 无显著变化 (z=-0.51)
PetSafe#4 · 10/11 · 62%–98%#4 · 8/11 · 43%–90%#5 · 9/11 · 52%–95%#4 · 10/12 · 55%–95%09-02→09-13 无显著变化 (z=-1.11); 09-13→09-20 无显著变化 (z=0.51)
尼卡萨#5 · 4/11 · 15%–65%#5 · 7/11 · 35%–85%#4 · 6/11 · 28%–79%#5 · 5/12 · 19%–68%09-02→09-13 无显著变化 (z=1.28); 09-13→09-20 无显著变化 (z=-0.43)
图 5宠物烘干箱/洗狗机中文提问
  • 小佩
  • 霍曼
  • 神宝
  • 欧科达
  • 简斯
  • 95% 区间
  • 竖线 = 面板或方法论变更,两侧不直接比较

数据:第 51、138、144、157 期公开榜单 · 可在 /rankings/45 核对

本图基于 12 个模型对 1 道问题(中文提问)的回答,每期每个模型问 1 次。采集时间 2026-09-02 至 2026-09-27,共 4 期;每期有效模型 10–12 个。区间为 95% Wilson 区间。逐期指数与问题原文可在 /rankings/45 查看。 2026-09-27 起有一次变更(换席 · 计分或方法论变更);此后的期次与之前的不直接比较。

表格视图
品牌09-02 #5109-13 #13809-20 #14409-27 #157相邻期判定
小佩#1 · 11/12 · 65%–99%#1 · 8/10 · 49%–94%#1 · 10/11 · 62%–98%#1 · 12/12 · 76%–100%09-02→09-13 无显著变化 (z=-0.79); 09-13→09-20 无显著变化 (z=0.71)
霍曼#2 · 9/12 · 47%–91%#2 · 7/10 · 40%–89%#2 · 7/11 · 35%–85%#2 · 9/12 · 47%–91%09-02→09-13 无显著变化 (z=-0.26); 09-13→09-20 无显著变化 (z=-0.31)
神宝#4 · 4/12 · 14%–61%#3 · 3/10 · 11%–60%#77 · 1/11 · 2%–38%#3 · 6/12 · 25%–75%09-02→09-13 无显著变化 (z=-0.17); 09-13→09-20 无显著变化 (z=-1.22)
欧科达#6 · 3/12 · 9%–53%— · 0/10 · 0%–28%— · 0/11 · 0%–26%#4 · 1/12 · 1%–35%09-02→09-13 无显著变化 (z=-1.70); 09-13→09-20 无显著变化 (z=0.00)
简斯#41 · 1/12 · 1%–35%— · 0/10 · 0%–28%#80 · 1/11 · 2%–38%#5 · 2/12 · 5%–45%09-02→09-13 无显著变化 (z=-0.93); 09-13→09-20 无显著变化 (z=0.98)
图 6宠物烘干箱/洗狗机英文提问
  • 小佩
  • Bissell
  • 霍曼
  • SHELANDY
  • Flying Pig Grooming
  • 95% 区间
  • 竖线 = 面板或方法论变更,两侧不直接比较

数据:第 49、139、145、158 期公开榜单 · 可在 /rankings/46 核对

本图基于 12 个模型对 1 道问题(英文提问)的回答,每期每个模型问 1 次。采集时间 2026-09-02 至 2026-09-27,共 4 期;每期有效模型 10–12 个。区间为 95% Wilson 区间。逐期指数与问题原文可在 /rankings/46 查看。 2026-09-27 起有一次变更(换席 · 计分或方法论变更);此后的期次与之前的不直接比较。

表格视图
品牌09-02 #4909-13 #13909-20 #14509-27 #158相邻期判定
小佩#1 · 5/10 · 24%–76%#1 · 8/11 · 43%–90%#2 · 5/11 · 21%–72%#1 · 6/12 · 25%–75%09-02→09-13 无显著变化 (z=1.07); 09-13→09-20 无显著变化 (z=-1.30)
Bissell#3 · 2/10 · 6%–51%#4 · 5/11 · 21%–72%#12 · 2/11 · 5%–48%#2 · 4/12 · 14%–61%09-02→09-13 无显著变化 (z=1.24); 09-13→09-20 无显著变化 (z=-1.37)
霍曼#5 · 4/10 · 17%–69%#3 · 4/11 · 15%–65%#1 · 5/11 · 21%–72%#3 · 2/12 · 5%–45%09-02→09-13 无显著变化 (z=-0.17); 09-13→09-20 无显著变化 (z=0.43)
SHELANDY#4 · 2/10 · 6%–51%#8 · 3/11 · 10%–57%#8 · 2/11 · 5%–48%#4 · 4/12 · 14%–61%09-02→09-13 无显著变化 (z=0.39); 09-13→09-20 无显著变化 (z=-0.51)
Flying Pig Grooming#2 · 7/10 · 40%–89%#2 · 7/11 · 35%–85%#3 · 7/11 · 35%–85%#5 · 6/12 · 25%–75%09-02→09-13 无显著变化 (z=-0.31); 09-13→09-20 无显著变化 (z=0.00)

样例二

在说哪些方面:AI 眼镜演示

12 个模型、中英两种语言,共 1,656 条回答:576 条只描述使用场景、不点名任何品牌;720 条直接点名问 5 个品牌(另有 360 条第三种点名问法不上本页,原因见本节末尾)。每条回答逐句归到冻结的方面分类表里。下面只写模型说了什么,不代表产品好坏,也不代表销量或市场份额。

采集于 2026-09-26 至 2026-09-27 · 纯模型面板 12 个模型 · 码本 v1 · ebffb8ae97c3

场景里想到谁

只描述一个使用场景、不点名任何品牌,比如「想买一副能当随身大屏看电影的 AR 眼镜,有什么推荐吗?」。每行一个品牌,两个点分别是中文提问和英文提问时提到它的回答占比,细线是 95% 区间。品牌名后面的两个数是它被首推的次数(中文 · 英文)。

场景 1观影 / 随身大屏中文问 n=72 · 英文问 n=72
  • 中文提问
  • 英文提问
  • 95% 区间

被首推次数最多的是 XREAL:中文 42 次、英文 41 次(每种语言 72 条回答)。中英差距最大的是 RayNeo:中文提问时 92% 的回答提到它,英文提问时 60%,相差 32 个百分点。

问法(中文):「想买一副能当随身大屏看电影的 AR 眼镜,有什么推荐吗?」「坐飞机、躺着追剧用的 AR 眼镜,哪款好?」;(英文):"I want a pair of AR glasses I can use as a portable big screen for movies. Any recommendations?" "What are good AR glasses for watching shows on a plane or in bed?"

表格视图
品牌中文提问 · 提到(k/n)95% 区间首推英文提问 · 提到(k/n)95% 区间首推
XREAL72/72 · 100%95%–100%4272/72 · 100%95%–100%41
Rokid69/72 · 96%89%–99%064/72 · 89%80%–94%0
RayNeo66/72 · 92%83%–96%443/72 · 60%48%–70%0
VITURE43/72 · 60%48%–70%065/72 · 90%81%–95%6
苹果13/72 · 18%11%–28%—29/72 · 40%30%–52%0
Meta(头显)12/72 · 17%10%–27%—26/72 · 36%26%–48%0
华为10/72 · 14%8%–24%—0/72未被提到—
场景 2出国旅行 / 翻译中文问 n=72 · 英文问 n=72
  • 中文提问
  • 英文提问
  • 95% 区间

被首推次数最多的是雷朋 Meta:中文 3 次、英文 23 次(每种语言 72 条回答)。中英差距最大的是 INMO:中文提问时 75% 的回答提到它,英文提问时 18%,相差 57 个百分点。

问法(中文):「出国旅游想带一副能实时翻译的 AI 眼镜,有哪些可以选?」「带同声翻译功能的智能眼镜,哪些比较好用?」;(英文):"I'm traveling abroad and want AI glasses that can translate conversations in real time. What are my options?" "Which smart glasses with live translation actually work well?"

表格视图
品牌中文提问 · 提到(k/n)95% 区间首推英文提问 · 提到(k/n)95% 区间首推
雷朋 Meta67/72 · 93%85%–97%371/72 · 99%93%–100%23
Even Realities46/72 · 64%52%–74%256/72 · 78%67%–86%3
INMO54/72 · 75%64%–84%113/72 · 18%11%–28%—
Rokid54/72 · 75%64%–84%130/72 · 42%31%–53%0
RayNeo51/72 · 71%60%–80%133/72 · 46%35%–57%0
XREAL33/72 · 46%35%–57%136/72 · 50%39%–61%2
Solos14/72 · 19%12%–30%—33/72 · 46%35%–57%1
场景 3拍照录像 / 记录生活中文问 n=72 · 英文问 n=72
  • 中文提问
  • 英文提问
  • 95% 区间

被首推次数最多的是雷朋 Meta:中文 48 次、英文 64 次(每种语言 72 条回答)。中英差距最大的是 RayNeo:中文提问时 60% 的回答提到它,英文提问时 10%,相差 50 个百分点。

问法(中文):「想要一副能随手拍照录像、记录日常的 AI 眼镜,买哪款好?」「带摄像头的智能眼镜,哪款比较值得买?」;(英文):"I'd like AI glasses that can take photos and videos hands-free to capture everyday moments. Which should I buy?" "Which camera glasses are worth buying?"

表格视图
品牌中文提问 · 提到(k/n)95% 区间首推英文提问 · 提到(k/n)95% 区间首推
雷朋 Meta72/72 · 100%95%–100%4872/72 · 100%95%–100%64
RayNeo43/72 · 60%48%–70%17/72 · 10%5%–19%—
Rokid41/72 · 57%45%–68%014/72 · 19%12%–30%—
小米40/72 · 56%44%–67%05/72 · 7%3%–15%—
Snap3/72 · 4%1%–12%—36/72 · 50%39%–61%0
华为27/72 · 38%27%–49%02/72 · 3%1%–10%—
闪极23/72 · 32%22%–43%02/72 · 3%1%–10%—
场景 4近视 / 全天佩戴中文问 n=72 · 英文问 n=72
  • 中文提问
  • 英文提问
  • 95% 区间

被首推次数最多的是雷朋 Meta:中文 11 次、英文 57 次(每种语言 72 条回答)。中英差距最大的是华为:中文提问时 86% 的回答提到它,英文提问时 6%,相差 81 个百分点。

问法(中文):「我近视,想买一副平时能一直戴着的 AI 眼镜,有什么推荐?」「能配近视度数、适合日常佩戴的智能眼镜有哪些?」;(英文):"I'm nearsighted and want AI glasses I can wear all day. What would you recommend?" "Which smart glasses work with prescription lenses for everyday wear?"

表格视图
品牌中文提问 · 提到(k/n)95% 区间首推英文提问 · 提到(k/n)95% 区间首推
雷朋 Meta69/72 · 96%89%–99%1172/72 · 100%95%–100%57
华为62/72 · 86%76%–92%114/72 · 6%2%–13%—
Even Realities26/72 · 36%26%–48%052/72 · 72%61%–81%0
Rokid51/72 · 71%60%–80%020/72 · 28%19%–39%0
RayNeo49/72 · 68%57%–78%39/72 · 13%7%–22%—
小米46/72 · 64%52%–74%12/72 · 3%1%–10%—
XREAL41/72 · 57%45%–68%039/72 · 54%43%–65%0

方法:12 个模型组成的纯模型面板(面板快照 a64ed9bbb94a),通过开发者接口提问,不联网。4 个场景,每个场景 2 种问法、各问 3 次;中文问法与英文问法各自独立撰写,不是互译,分开计算,每个场景每种语言 72 条回答。问法里不点名品牌、不加格式要求、不要求列出前几名。采集于 2026-09-26 至 2026-09-27。「提到」= 提到该品牌的回答占比,区间为 95% Wilson 区间,一次都没被提到的一侧不画点。「首推」= 被明确作为首选推荐的次数,每条回答至多一个,由编码员按码本规则判断(双编一致率 97.5%);某一侧被提到不足 20 次时不报首推,记为「—」。每个场景列出两种语言中较高一侧提及比例排前 7 的品牌;子品牌并入母品牌。

点名时说什么

直接点名问,用两种问法:「介绍一下{品牌}的智能眼镜。」和「{品牌}的眼镜怎么样?」。「提到」是谈到这个方面的回答占比;「其中带缺点」是这些回答里至少有一句负面陈述的占比,底色越深占比越高。每个品牌只列出至少一种语言里提及比例 ≥ 50% 的方面。

点名问时,多数方面的提及比例都在一半以上;品牌之间、语言之间的差别,更多落在「其中带缺点」一列。

品牌 1XREAL每种语言 n=72
  • 中文提问
  • 英文提问
其中带缺点0%100%
方面中文提问英文提问中英差异
提到其中带缺点提到其中带缺点
显示与光学100%78%100%79%
佩戴舒适与便携100%51%100%35%
连接、兼容与软件生态100%89%100%81%
空间定位与操控交互99%63%100%65%
观影与娱乐体验100%25%97%21%
办公与生产力94%12%99%21%
品牌与公司99%4%90%0%中文更常提
价格与性价比81%33%72%14%
外观与社交接受度63%2%78%36%英文更常提
近视与镜片方案61%80%71%63%
续航与供电43%87%56%48%
音频与通话31%36%61%41%英文更常提

带缺点比例最高的方面是「连接、兼容与软件生态」:中文 89%、英文 81%。

表格视图
方面中文提问 · 提到95% 区间其中带缺点英文提问 · 提到95% 区间其中带缺点中英差异
显示与光学72/72 · 100%95%–100%78%72/72 · 100%95%–100%79%—
佩戴舒适与便携72/72 · 100%95%–100%51%72/72 · 100%95%–100%35%—
连接、兼容与软件生态72/72 · 100%95%–100%89%72/72 · 100%95%–100%81%—
空间定位与操控交互71/72 · 99%93%–100%63%72/72 · 100%95%–100%65%—
观影与娱乐体验72/72 · 100%95%–100%25%70/72 · 97%90%–99%21%—
办公与生产力68/72 · 94%87%–98%12%71/72 · 99%93%–100%21%—
品牌与公司71/72 · 99%93%–100%4%65/72 · 90%81%–95%0%中文更常提
价格与性价比58/72 · 81%70%–88%33%52/72 · 72%61%–81%14%—
外观与社交接受度45/72 · 63%51%–73%2%56/72 · 78%67%–86%36%英文更常提
近视与镜片方案44/72 · 61%50%–72%80%51/72 · 71%60%–80%63%—
续航与供电31/72 · 43%32%–55%87%40/72 · 56%44%–67%48%—
音频与通话22/72 · 31%21%–42%36%44/72 · 61%50%–72%41%英文更常提
品牌 2Rokid每种语言 n=72
  • 中文提问
  • 英文提问
其中带缺点0%100%
方面中文提问英文提问中英差异
提到其中带缺点提到其中带缺点
显示与光学100%65%99%54%
佩戴舒适与便携100%44%99%30%
连接、兼容与软件生态100%69%99%68%
观影与娱乐体验97%19%97%14%
办公与生产力85%18%97%14%英文更常提
品牌与公司100%8%82%0%中文更常提
空间定位与操控交互81%62%86%66%
近视与镜片方案81%22%78%16%
AI 助手与智能功能79%9%69%4%
外观与社交接受度67%6%76%18%
音频与通话50%19%75%37%英文更常提
拍照与录像61%7%63%4%
价格与性价比71%28%53%11%中文更常提
翻译与字幕63%0%53%0%
续航与供电57%78%54%51%

带缺点比例最高的方面是「连接、兼容与软件生态」:中文 69%、英文 68%。

表格视图
方面中文提问 · 提到95% 区间其中带缺点英文提问 · 提到95% 区间其中带缺点中英差异
显示与光学72/72 · 100%95%–100%65%71/72 · 99%93%–100%54%—
佩戴舒适与便携72/72 · 100%95%–100%44%71/72 · 99%93%–100%30%—
连接、兼容与软件生态72/72 · 100%95%–100%69%71/72 · 99%93%–100%68%—
观影与娱乐体验70/72 · 97%90%–99%19%70/72 · 97%90%–99%14%—
办公与生产力61/72 · 85%75%–91%18%70/72 · 97%90%–99%14%英文更常提
品牌与公司72/72 · 100%95%–100%8%59/72 · 82%72%–89%0%中文更常提
空间定位与操控交互58/72 · 81%70%–88%62%62/72 · 86%76%–92%66%—
近视与镜片方案58/72 · 81%70%–88%22%56/72 · 78%67%–86%16%—
AI 助手与智能功能57/72 · 79%68%–87%9%50/72 · 69%58%–79%4%—
外观与社交接受度48/72 · 67%55%–77%6%55/72 · 76%65%–85%18%—
音频与通话36/72 · 50%39%–61%19%54/72 · 75%64%–84%37%英文更常提
拍照与录像44/72 · 61%50%–72%7%45/72 · 63%51%–73%4%—
价格与性价比51/72 · 71%60%–80%28%38/72 · 53%41%–64%11%中文更常提
翻译与字幕45/72 · 63%51%–73%0%38/72 · 53%41%–64%0%—
续航与供电41/72 · 57%45%–68%78%39/72 · 54%43%–65%51%—
品牌 3小米每种语言 n=72
  • 中文提问
  • 英文提问
其中带缺点0%100%
方面中文提问英文提问中英差异
提到其中带缺点提到其中带缺点
拍照与录像94%28%93%9%
显示与光学88%38%99%30%英文更常提
佩戴舒适与便携97%43%89%33%中文更常提
AI 助手与智能功能88%13%92%8%
音频与通话85%46%90%26%
品牌与公司83%20%90%15%
外观与社交接受度78%23%94%25%英文更常提
连接、兼容与软件生态81%48%90%40%
上市地区与服务可用性69%98%96%99%英文更常提
翻译与字幕78%2%86%5%
续航与供电75%65%63%56%
价格与性价比75%24%60%19%
近视与镜片方案68%16%57%15%
空间定位与操控交互42%10%79%12%英文更常提

带缺点比例最高的方面是「上市地区与服务可用性」:中文 98%、英文 99%。

表格视图
方面中文提问 · 提到95% 区间其中带缺点英文提问 · 提到95% 区间其中带缺点中英差异
拍照与录像68/72 · 94%87%–98%28%67/72 · 93%85%–97%9%—
显示与光学63/72 · 88%78%–93%38%71/72 · 99%93%–100%30%英文更常提
佩戴舒适与便携70/72 · 97%90%–99%43%64/72 · 89%80%–94%33%中文更常提
AI 助手与智能功能63/72 · 88%78%–93%13%66/72 · 92%83%–96%8%—
音频与通话61/72 · 85%75%–91%46%65/72 · 90%81%–95%26%—
品牌与公司60/72 · 83%73%–90%20%65/72 · 90%81%–95%15%—
外观与社交接受度56/72 · 78%67%–86%23%68/72 · 94%87%–98%25%英文更常提
连接、兼容与软件生态58/72 · 81%70%–88%48%65/72 · 90%81%–95%40%—
上市地区与服务可用性50/72 · 69%58%–79%98%69/72 · 96%89%–99%99%英文更常提
翻译与字幕56/72 · 78%67%–86%2%62/72 · 86%76%–92%5%—
续航与供电54/72 · 75%64%–84%65%45/72 · 63%51%–73%56%—
价格与性价比54/72 · 75%64%–84%24%43/72 · 60%48%–70%19%—
近视与镜片方案49/72 · 68%57%–78%16%41/72 · 57%45%–68%15%—
空间定位与操控交互30/72 · 42%31%–53%10%57/72 · 79%68%–87%12%英文更常提
品牌 4阿里千问每种语言 n=72
  • 中文提问
  • 英文提问
其中带缺点0%100%
方面中文提问英文提问中英差异
提到其中带缺点提到其中带缺点
品牌与公司94%7%93%3%
AI 助手与智能功能86%14%92%6%
翻译与字幕68%0%81%2%
连接、兼容与软件生态68%31%72%21%
上市地区与服务可用性54%100%69%90%
拍照与录像44%3%71%4%英文更常提
音频与通话36%15%67%4%英文更常提
显示与光学35%36%53%18%英文更常提

带缺点比例最高的方面是「上市地区与服务可用性」:中文 100%、英文 90%。

上表的回答里,有 9 条把「阿里千问」当成千问大模型来介绍,没有谈眼镜(中文 5 条、英文 4 条),它们照常计入分母。在上面四个场景的 576 条回答里,提到阿里千问的中文回答 2 条、英文回答 0 条。

读法这款眼镜发布较晚,最可能的原因是这些模型的训练数据早于它的发布。这里测到的是模型的记忆里还没有这款产品,不能解读为模型不认可它。

表格视图
方面中文提问 · 提到95% 区间其中带缺点英文提问 · 提到95% 区间其中带缺点中英差异
品牌与公司68/72 · 94%87%–98%7%67/72 · 93%85%–97%3%—
AI 助手与智能功能62/72 · 86%76%–92%14%66/72 · 92%83%–96%6%—
翻译与字幕49/72 · 68%57%–78%0%58/72 · 81%70%–88%2%—
连接、兼容与软件生态49/72 · 68%57%–78%31%52/72 · 72%61%–81%21%—
上市地区与服务可用性39/72 · 54%43%–65%100%50/72 · 69%58%–79%90%—
拍照与录像32/72 · 44%34%–56%3%51/72 · 71%60%–80%4%英文更常提
音频与通话26/72 · 36%26%–48%15%48/72 · 67%55%–77%4%英文更常提
显示与光学25/72 · 35%25%–46%36%38/72 · 53%41%–64%18%英文更常提
品牌 5雷朋 Meta每种语言 n=72
  • 中文提问
  • 英文提问
其中带缺点0%100%
方面中文提问英文提问中英差异
提到其中带缺点提到其中带缺点
拍照与录像100%49%100%51%
音频与通话100%29%100%44%
外观与社交接受度100%6%100%10%
续航与供电100%75%100%67%
AI 助手与智能功能99%34%100%14%
品牌与公司100%4%97%6%
隐私与安全风险93%79%96%84%
连接、兼容与软件生态89%64%88%60%
近视与镜片方案82%27%92%23%
翻译与字幕83%7%86%5%
价格与性价比85%49%74%26%
显示与光学74%83%75%76%
上市地区与服务可用性97%100%51%89%中文更常提
佩戴舒适与便携81%24%60%28%中文更常提
做工、稳定性与售后47%50%50%50%

带缺点比例最高的方面是「上市地区与服务可用性」:中文 100%、英文 89%。

表格视图
方面中文提问 · 提到95% 区间其中带缺点英文提问 · 提到95% 区间其中带缺点中英差异
拍照与录像72/72 · 100%95%–100%49%72/72 · 100%95%–100%51%—
音频与通话72/72 · 100%95%–100%29%72/72 · 100%95%–100%44%—
外观与社交接受度72/72 · 100%95%–100%6%72/72 · 100%95%–100%10%—
续航与供电72/72 · 100%95%–100%75%72/72 · 100%95%–100%67%—
AI 助手与智能功能71/72 · 99%93%–100%34%72/72 · 100%95%–100%14%—
品牌与公司72/72 · 100%95%–100%4%70/72 · 97%90%–99%6%—
隐私与安全风险67/72 · 93%85%–97%79%69/72 · 96%89%–99%84%—
连接、兼容与软件生态64/72 · 89%80%–94%64%63/72 · 88%78%–93%60%—
近视与镜片方案59/72 · 82%72%–89%27%66/72 · 92%83%–96%23%—
翻译与字幕60/72 · 83%73%–90%7%62/72 · 86%76%–92%5%—
价格与性价比61/72 · 85%75%–91%49%53/72 · 74%62%–82%26%—
显示与光学53/72 · 74%62%–82%83%54/72 · 75%64%–84%76%—
上市地区与服务可用性70/72 · 97%90%–99%100%37/72 · 51%40%–63%89%中文更常提
佩戴舒适与便携58/72 · 81%70%–88%24%43/72 · 60%48%–70%28%中文更常提
做工、稳定性与售后34/72 · 47%36%–59%50%36/72 · 50%39%–61%50%—

方法:两种点名问法,中文「介绍一下{品牌}的智能眼镜。」「{品牌}的眼镜怎么样?」;英文独立撰写:"Tell me about {brand}'s smart glasses." "What are {brand} glasses like?"。{品牌} 处中文问法写品牌的中文名,英文问法写英文名。每个品牌每种语言 2 种问法 × 3 次 × 12 个模型 = 72 条回答,面板与采集时间同上。每条回答逐句归到冻结的码本 v1 的 18 个方面(另有「其他」),码本 sha256 前 12 位 ebffb8ae97c3。「提到」= 至少一句谈到该方面的回答占比,区间为 95% Wilson 区间,见表格视图;「其中带缺点」= 这些回答里至少有一句负面陈述的占比,谈到该方面的回答少于 20 条时不报。「中英差异」只在两侧都至少 20 条时做两比例检验,p < 0.05 才标出。信度:随机抽取 336 条回答由第二位编码员独立再编,19 个代码的 Cohen's κ 在 0.87 到 0.98 之间,负面判断一致率 97.2%。

后续样例

提及率变化样例

数据采集中

同一组冻结的问题、深度采样的两期数据,逐格给出三档判定。两期都采集完成后放在这里。

本页的汇编数据(名次、模型覆盖、提及比例、区间、变更断点)以 CC BY 4.0 许可发布,引用时请注明 ask10ais 与测量日期。模型原始回答的权利归各模型提供方,我们只是原样保存,供人核验。

来信咨询hello@ask10ais.com

本记录测量的是大语言模型在某一时刻对某一问题的输出,不是对产品质量、市场份额或企业资质的评价。模型输出可能包含错误或虚构信息;本记录如实保存模型的原始返回,不代表我们认可其内容。本记录不构成投资建议或采购建议。