AI 可见度监测 · 样例报告
两份样例报告
两份样例都用真实数据生成,不是截图,也没有编造任何数字。不用留邮箱。
样例一
名次监测
这一份由我们已经公开的每周监测数据现场生成。6 道周线题(宠物品类,中文问一遍、英文问一遍),每期每个模型问一次。
数据截至 2026-09-27 · 共 5 期 · 面板 12 个模型
各题名次与模型覆盖
- 小佩
- PETLIBRO
- 小米
- CATLINK
- PetSafe
- 95% 区间
- 竖线 = 面板或方法论变更,两侧不直接比较
本图基于 12 个模型对 1 道问题(中文提问)的回答,每期每个模型问 1 次。采集时间 2026-08-24 至 2026-09-27,共 5 期;每期有效模型 11–12 个。区间为 95% Wilson 区间。逐期指数与问题原文可在 /rankings/15 查看。 2026-09-27 起有一次变更(换席 · 计分或方法论变更);此后的期次与之前的不直接比较。
表格视图
| 品牌 | 08-24 #17 | 09-02 #44 | 09-13 #134 | 09-20 #140 | 09-27 #153 | 相邻期判定 |
|---|---|---|---|---|---|---|
| 小佩 | #1 · 11/11 · 74%–100% | #1 · 11/12 · 65%–99% | #1 · 11/11 · 74%–100% | #1 · 11/11 · 74%–100% | #1 · 12/12 · 76%–100% | 09-02→09-13 无显著变化 (z=0.98); 09-13→09-20 无显著变化 (z=0.00) |
| PETLIBRO | #3 · 9/11 · 52%–95% | #2 · 8/12 · 39%–86% | #2 · 9/11 · 52%–95% | #2 · 10/11 · 62%–98% | #2 · 9/12 · 47%–91% | 09-02→09-13 无显著变化 (z=0.83); 09-13→09-20 无显著变化 (z=0.62) |
| 小米 | #2 · 10/11 · 62%–98% | #3 · 10/12 · 55%–95% | #3 · 9/11 · 52%–95% | #7 · 7/11 · 35%–85% | #3 · 10/12 · 55%–95% | 09-02→09-13 无显著变化 (z=-0.10); 09-13→09-20 无显著变化 (z=-0.96) |
| CATLINK | #4 · 8/11 · 43%–90% | #8 · 4/12 · 14%–61% | #6 · 6/11 · 28%–79% | #6 · 5/11 · 21%–72% | #4 · 9/12 · 47%–91% | 09-02→09-13 无显著变化 (z=1.03); 09-13→09-20 无显著变化 (z=-0.43) |
| PetSafe | #5 · 7/11 · 35%–85% | #4 · 10/12 · 55%–95% | #4 · 9/11 · 52%–95% | #4 · 9/11 · 52%–95% | #5 · 9/12 · 47%–91% | 09-02→09-13 无显著变化 (z=-0.10); 09-13→09-20 无显著变化 (z=0.00) |
- PETLIBRO
- PetSafe
- WOPET
- 小佩
- Sure Petcare
- 95% 区间
- 竖线 = 面板或方法论变更,两侧不直接比较
本图基于 12 个模型对 1 道问题(英文提问)的回答,每期每个模型问 1 次。采集时间 2026-09-02 至 2026-09-27,共 4 期;每期有效模型 10–12 个。区间为 95% Wilson 区间。逐期指数与问题原文可在 /rankings/42 查看。 2026-09-27 起有一次变更(换席 · 计分或方法论变更);此后的期次与之前的不直接比较。
表格视图
| 品牌 | 09-02 #50 | 09-13 #135 | 09-20 #141 | 09-27 #154 | 相邻期判定 |
|---|---|---|---|---|---|
| PETLIBRO | #1 · 11/12 · 65%–99% | #1 · 11/11 · 74%–100% | #2 · 9/10 · 60%–98% | #1 · 12/12 · 76%–100% | 09-02→09-13 无显著变化 (z=0.98); 09-13→09-20 无显著变化 (z=-1.07) |
| PetSafe | #2 · 11/12 · 65%–99% | #3 · 11/11 · 74%–100% | #1 · 10/10 · 72%–100% | #2 · 12/12 · 76%–100% | 09-02→09-13 无显著变化 (z=0.98); 09-13→09-20 无显著变化 (z=0.00) |
| WOPET | #3 · 12/12 · 76%–100% | #4 · 10/11 · 62%–98% | #3 · 10/10 · 72%–100% | #3 · 11/12 · 65%–99% | 09-02→09-13 无显著变化 (z=-1.07); 09-13→09-20 无显著变化 (z=0.98) |
| 小佩 | #4 · 11/12 · 65%–99% | #2 · 10/11 · 62%–98% | #4 · 9/10 · 60%–98% | #4 · 10/12 · 55%–95% | 09-02→09-13 无显著变化 (z=-0.06); 09-13→09-20 无显著变化 (z=-0.07) |
| Sure Petcare | #5 · 11/12 · 65%–99% | #5 · 11/11 · 74%–100% | #5 · 9/10 · 60%–98% | #5 · 10/12 · 55%–95% | 09-02→09-13 无显著变化 (z=0.98); 09-13→09-20 无显著变化 (z=-1.07) |
- 小佩
- Litter-Robot
- CATLINK
- PetSafe
- 霍曼
- 95% 区间
- 竖线 = 面板或方法论变更,两侧不直接比较
本图基于 12 个模型对 1 道问题(中文提问)的回答,每期每个模型问 1 次。采集时间 2026-09-02 至 2026-09-27,共 4 期;每期有效模型 11–12 个。区间为 95% Wilson 区间。逐期指数与问题原文可在 /rankings/43 查看。 2026-09-27 起有一次变更(换席 · 计分或方法论变更);此后的期次与之前的不直接比较。
表格视图
| 品牌 | 09-02 #46 | 09-13 #136 | 09-20 #142 | 09-27 #155 | 相邻期判定 |
|---|---|---|---|---|---|
| 小佩 | #1 · 12/12 · 76%–100% | #1 · 11/11 · 74%–100% | #1 · 11/11 · 74%–100% | #1 · 11/12 · 65%–99% | 09-02→09-13 无显著变化 (z=0.00); 09-13→09-20 无显著变化 (z=0.00) |
| Litter-Robot | #2 · 11/12 · 65%–99% | #2 · 11/11 · 74%–100% | #3 · 10/11 · 62%–98% | #2 · 11/12 · 65%–99% | 09-02→09-13 无显著变化 (z=0.98); 09-13→09-20 无显著变化 (z=-1.02) |
| CATLINK | #3 · 10/12 · 55%–95% | #3 · 10/11 · 62%–98% | #2 · 11/11 · 74%–100% | #3 · 12/12 · 76%–100% | 09-02→09-13 无显著变化 (z=0.54); 09-13→09-20 无显著变化 (z=1.02) |
| PetSafe | #4 · 9/12 · 47%–91% | #6 · 8/11 · 43%–90% | #4 · 9/11 · 52%–95% | #4 · 11/12 · 65%–99% | 09-02→09-13 无显著变化 (z=-0.12); 09-13→09-20 无显著变化 (z=0.51) |
| 霍曼 | #6 · 6/12 · 25%–75% | #5 · 7/11 · 35%–85% | #7 · 6/11 · 28%–79% | #5 · 9/12 · 47%–91% | 09-02→09-13 无显著变化 (z=0.66); 09-13→09-20 无显著变化 (z=-0.43) |
- Litter-Robot
- 小佩
- CATLINK
- PetSafe
- 尼卡萨
- 95% 区间
- 竖线 = 面板或方法论变更,两侧不直接比较
本图基于 12 个模型对 1 道问题(英文提问)的回答,每期每个模型问 1 次。采集时间 2026-09-02 至 2026-09-27,共 4 期;每期有效模型 11–12 个。区间为 95% Wilson 区间。逐期指数与问题原文可在 /rankings/44 查看。 2026-09-27 起有一次变更(换席 · 计分或方法论变更);此后的期次与之前的不直接比较。
表格视图
| 品牌 | 09-02 #47 | 09-13 #137 | 09-20 #143 | 09-27 #156 | 相邻期判定 |
|---|---|---|---|---|---|
| Litter-Robot | #1 · 11/11 · 74%–100% | #1 · 11/11 · 74%–100% | #1 · 10/11 · 62%–98% | #1 · 12/12 · 76%–100% | 09-02→09-13 无显著变化 (z=0.00); 09-13→09-20 无显著变化 (z=-1.02) |
| 小佩 | #2 · 11/11 · 74%–100% | #2 · 11/11 · 74%–100% | #2 · 10/11 · 62%–98% | #2 · 12/12 · 76%–100% | 09-02→09-13 无显著变化 (z=0.00); 09-13→09-20 无显著变化 (z=-1.02) |
| CATLINK | #3 · 10/11 · 62%–98% | #3 · 9/11 · 52%–95% | #3 · 8/11 · 43%–90% | #3 · 12/12 · 76%–100% | 09-02→09-13 无显著变化 (z=-0.62); 09-13→09-20 无显著变化 (z=-0.51) |
| PetSafe | #4 · 10/11 · 62%–98% | #4 · 8/11 · 43%–90% | #5 · 9/11 · 52%–95% | #4 · 10/12 · 55%–95% | 09-02→09-13 无显著变化 (z=-1.11); 09-13→09-20 无显著变化 (z=0.51) |
| 尼卡萨 | #5 · 4/11 · 15%–65% | #5 · 7/11 · 35%–85% | #4 · 6/11 · 28%–79% | #5 · 5/12 · 19%–68% | 09-02→09-13 无显著变化 (z=1.28); 09-13→09-20 无显著变化 (z=-0.43) |
- 小佩
- 霍曼
- 神宝
- 欧科达
- 简斯
- 95% 区间
- 竖线 = 面板或方法论变更,两侧不直接比较
本图基于 12 个模型对 1 道问题(中文提问)的回答,每期每个模型问 1 次。采集时间 2026-09-02 至 2026-09-27,共 4 期;每期有效模型 10–12 个。区间为 95% Wilson 区间。逐期指数与问题原文可在 /rankings/45 查看。 2026-09-27 起有一次变更(换席 · 计分或方法论变更);此后的期次与之前的不直接比较。
表格视图
| 品牌 | 09-02 #51 | 09-13 #138 | 09-20 #144 | 09-27 #157 | 相邻期判定 |
|---|---|---|---|---|---|
| 小佩 | #1 · 11/12 · 65%–99% | #1 · 8/10 · 49%–94% | #1 · 10/11 · 62%–98% | #1 · 12/12 · 76%–100% | 09-02→09-13 无显著变化 (z=-0.79); 09-13→09-20 无显著变化 (z=0.71) |
| 霍曼 | #2 · 9/12 · 47%–91% | #2 · 7/10 · 40%–89% | #2 · 7/11 · 35%–85% | #2 · 9/12 · 47%–91% | 09-02→09-13 无显著变化 (z=-0.26); 09-13→09-20 无显著变化 (z=-0.31) |
| 神宝 | #4 · 4/12 · 14%–61% | #3 · 3/10 · 11%–60% | #77 · 1/11 · 2%–38% | #3 · 6/12 · 25%–75% | 09-02→09-13 无显著变化 (z=-0.17); 09-13→09-20 无显著变化 (z=-1.22) |
| 欧科达 | #6 · 3/12 · 9%–53% | — · 0/10 · 0%–28% | — · 0/11 · 0%–26% | #4 · 1/12 · 1%–35% | 09-02→09-13 无显著变化 (z=-1.70); 09-13→09-20 无显著变化 (z=0.00) |
| 简斯 | #41 · 1/12 · 1%–35% | — · 0/10 · 0%–28% | #80 · 1/11 · 2%–38% | #5 · 2/12 · 5%–45% | 09-02→09-13 无显著变化 (z=-0.93); 09-13→09-20 无显著变化 (z=0.98) |
- 小佩
- Bissell
- 霍曼
- SHELANDY
- Flying Pig Grooming
- 95% 区间
- 竖线 = 面板或方法论变更,两侧不直接比较
本图基于 12 个模型对 1 道问题(英文提问)的回答,每期每个模型问 1 次。采集时间 2026-09-02 至 2026-09-27,共 4 期;每期有效模型 10–12 个。区间为 95% Wilson 区间。逐期指数与问题原文可在 /rankings/46 查看。 2026-09-27 起有一次变更(换席 · 计分或方法论变更);此后的期次与之前的不直接比较。
表格视图
| 品牌 | 09-02 #49 | 09-13 #139 | 09-20 #145 | 09-27 #158 | 相邻期判定 |
|---|---|---|---|---|---|
| 小佩 | #1 · 5/10 · 24%–76% | #1 · 8/11 · 43%–90% | #2 · 5/11 · 21%–72% | #1 · 6/12 · 25%–75% | 09-02→09-13 无显著变化 (z=1.07); 09-13→09-20 无显著变化 (z=-1.30) |
| Bissell | #3 · 2/10 · 6%–51% | #4 · 5/11 · 21%–72% | #12 · 2/11 · 5%–48% | #2 · 4/12 · 14%–61% | 09-02→09-13 无显著变化 (z=1.24); 09-13→09-20 无显著变化 (z=-1.37) |
| 霍曼 | #5 · 4/10 · 17%–69% | #3 · 4/11 · 15%–65% | #1 · 5/11 · 21%–72% | #3 · 2/12 · 5%–45% | 09-02→09-13 无显著变化 (z=-0.17); 09-13→09-20 无显著变化 (z=0.43) |
| SHELANDY | #4 · 2/10 · 6%–51% | #8 · 3/11 · 10%–57% | #8 · 2/11 · 5%–48% | #4 · 4/12 · 14%–61% | 09-02→09-13 无显著变化 (z=0.39); 09-13→09-20 无显著变化 (z=-0.51) |
| Flying Pig Grooming | #2 · 7/10 · 40%–89% | #2 · 7/11 · 35%–85% | #3 · 7/11 · 35%–85% | #5 · 6/12 · 25%–75% | 09-02→09-13 无显著变化 (z=-0.31); 09-13→09-20 无显著变化 (z=0.00) |
样例二
在说哪些方面:AI 眼镜演示
12 个模型、中英两种语言,共 1,656 条回答:576 条只描述使用场景、不点名任何品牌;720 条直接点名问 5 个品牌(另有 360 条第三种点名问法不上本页,原因见本节末尾)。每条回答逐句归到冻结的方面分类表里。下面只写模型说了什么,不代表产品好坏,也不代表销量或市场份额。
采集于 2026-09-26 至 2026-09-27 · 纯模型面板 12 个模型 · 码本 v1 · ebffb8ae97c3
场景里想到谁
只描述一个使用场景、不点名任何品牌,比如「想买一副能当随身大屏看电影的 AR 眼镜,有什么推荐吗?」。每行一个品牌,两个点分别是中文提问和英文提问时提到它的回答占比,细线是 95% 区间。品牌名后面的两个数是它被首推的次数(中文 · 英文)。
- 中文提问
- 英文提问
- 95% 区间
被首推次数最多的是 XREAL:中文 42 次、英文 41 次(每种语言 72 条回答)。中英差距最大的是 RayNeo:中文提问时 92% 的回答提到它,英文提问时 60%,相差 32 个百分点。
问法(中文):「想买一副能当随身大屏看电影的 AR 眼镜,有什么推荐吗?」「坐飞机、躺着追剧用的 AR 眼镜,哪款好?」;(英文):"I want a pair of AR glasses I can use as a portable big screen for movies. Any recommendations?" "What are good AR glasses for watching shows on a plane or in bed?"
表格视图
| 品牌 | 中文提问 · 提到(k/n) | 95% 区间 | 首推 | 英文提问 · 提到(k/n) | 95% 区间 | 首推 |
|---|---|---|---|---|---|---|
| XREAL | 72/72 · 100% | 95%–100% | 42 | 72/72 · 100% | 95%–100% | 41 |
| Rokid | 69/72 · 96% | 89%–99% | 0 | 64/72 · 89% | 80%–94% | 0 |
| RayNeo | 66/72 · 92% | 83%–96% | 4 | 43/72 · 60% | 48%–70% | 0 |
| VITURE | 43/72 · 60% | 48%–70% | 0 | 65/72 · 90% | 81%–95% | 6 |
| 苹果 | 13/72 · 18% | 11%–28% | — | 29/72 · 40% | 30%–52% | 0 |
| Meta(头显) | 12/72 · 17% | 10%–27% | — | 26/72 · 36% | 26%–48% | 0 |
| 华为 | 10/72 · 14% | 8%–24% | — | 0/72 | 未被提到 | — |
- 中文提问
- 英文提问
- 95% 区间
被首推次数最多的是雷朋 Meta:中文 3 次、英文 23 次(每种语言 72 条回答)。中英差距最大的是 INMO:中文提问时 75% 的回答提到它,英文提问时 18%,相差 57 个百分点。
问法(中文):「出国旅游想带一副能实时翻译的 AI 眼镜,有哪些可以选?」「带同声翻译功能的智能眼镜,哪些比较好用?」;(英文):"I'm traveling abroad and want AI glasses that can translate conversations in real time. What are my options?" "Which smart glasses with live translation actually work well?"
表格视图
| 品牌 | 中文提问 · 提到(k/n) | 95% 区间 | 首推 | 英文提问 · 提到(k/n) | 95% 区间 | 首推 |
|---|---|---|---|---|---|---|
| 雷朋 Meta | 67/72 · 93% | 85%–97% | 3 | 71/72 · 99% | 93%–100% | 23 |
| Even Realities | 46/72 · 64% | 52%–74% | 2 | 56/72 · 78% | 67%–86% | 3 |
| INMO | 54/72 · 75% | 64%–84% | 1 | 13/72 · 18% | 11%–28% | — |
| Rokid | 54/72 · 75% | 64%–84% | 1 | 30/72 · 42% | 31%–53% | 0 |
| RayNeo | 51/72 · 71% | 60%–80% | 1 | 33/72 · 46% | 35%–57% | 0 |
| XREAL | 33/72 · 46% | 35%–57% | 1 | 36/72 · 50% | 39%–61% | 2 |
| Solos | 14/72 · 19% | 12%–30% | — | 33/72 · 46% | 35%–57% | 1 |
- 中文提问
- 英文提问
- 95% 区间
被首推次数最多的是雷朋 Meta:中文 48 次、英文 64 次(每种语言 72 条回答)。中英差距最大的是 RayNeo:中文提问时 60% 的回答提到它,英文提问时 10%,相差 50 个百分点。
问法(中文):「想要一副能随手拍照录像、记录日常的 AI 眼镜,买哪款好?」「带摄像头的智能眼镜,哪款比较值得买?」;(英文):"I'd like AI glasses that can take photos and videos hands-free to capture everyday moments. Which should I buy?" "Which camera glasses are worth buying?"
表格视图
| 品牌 | 中文提问 · 提到(k/n) | 95% 区间 | 首推 | 英文提问 · 提到(k/n) | 95% 区间 | 首推 |
|---|---|---|---|---|---|---|
| 雷朋 Meta | 72/72 · 100% | 95%–100% | 48 | 72/72 · 100% | 95%–100% | 64 |
| RayNeo | 43/72 · 60% | 48%–70% | 1 | 7/72 · 10% | 5%–19% | — |
| Rokid | 41/72 · 57% | 45%–68% | 0 | 14/72 · 19% | 12%–30% | — |
| 小米 | 40/72 · 56% | 44%–67% | 0 | 5/72 · 7% | 3%–15% | — |
| Snap | 3/72 · 4% | 1%–12% | — | 36/72 · 50% | 39%–61% | 0 |
| 华为 | 27/72 · 38% | 27%–49% | 0 | 2/72 · 3% | 1%–10% | — |
| 闪极 | 23/72 · 32% | 22%–43% | 0 | 2/72 · 3% | 1%–10% | — |
- 中文提问
- 英文提问
- 95% 区间
被首推次数最多的是雷朋 Meta:中文 11 次、英文 57 次(每种语言 72 条回答)。中英差距最大的是华为:中文提问时 86% 的回答提到它,英文提问时 6%,相差 81 个百分点。
问法(中文):「我近视,想买一副平时能一直戴着的 AI 眼镜,有什么推荐?」「能配近视度数、适合日常佩戴的智能眼镜有哪些?」;(英文):"I'm nearsighted and want AI glasses I can wear all day. What would you recommend?" "Which smart glasses work with prescription lenses for everyday wear?"
表格视图
| 品牌 | 中文提问 · 提到(k/n) | 95% 区间 | 首推 | 英文提问 · 提到(k/n) | 95% 区间 | 首推 |
|---|---|---|---|---|---|---|
| 雷朋 Meta | 69/72 · 96% | 89%–99% | 11 | 72/72 · 100% | 95%–100% | 57 |
| 华为 | 62/72 · 86% | 76%–92% | 11 | 4/72 · 6% | 2%–13% | — |
| Even Realities | 26/72 · 36% | 26%–48% | 0 | 52/72 · 72% | 61%–81% | 0 |
| Rokid | 51/72 · 71% | 60%–80% | 0 | 20/72 · 28% | 19%–39% | 0 |
| RayNeo | 49/72 · 68% | 57%–78% | 3 | 9/72 · 13% | 7%–22% | — |
| 小米 | 46/72 · 64% | 52%–74% | 1 | 2/72 · 3% | 1%–10% | — |
| XREAL | 41/72 · 57% | 45%–68% | 0 | 39/72 · 54% | 43%–65% | 0 |
方法:12 个模型组成的纯模型面板(面板快照 a64ed9bbb94a),通过开发者接口提问,不联网。4 个场景,每个场景 2 种问法、各问 3 次;中文问法与英文问法各自独立撰写,不是互译,分开计算,每个场景每种语言 72 条回答。问法里不点名品牌、不加格式要求、不要求列出前几名。采集于 2026-09-26 至 2026-09-27。「提到」= 提到该品牌的回答占比,区间为 95% Wilson 区间,一次都没被提到的一侧不画点。「首推」= 被明确作为首选推荐的次数,每条回答至多一个,由编码员按码本规则判断(双编一致率 97.5%);某一侧被提到不足 20 次时不报首推,记为「—」。每个场景列出两种语言中较高一侧提及比例排前 7 的品牌;子品牌并入母品牌。
点名时说什么
直接点名问,用两种问法:「介绍一下{品牌}的智能眼镜。」和「{品牌}的眼镜怎么样?」。「提到」是谈到这个方面的回答占比;「其中带缺点」是这些回答里至少有一句负面陈述的占比,底色越深占比越高。每个品牌只列出至少一种语言里提及比例 ≥ 50% 的方面。
点名问时,多数方面的提及比例都在一半以上;品牌之间、语言之间的差别,更多落在「其中带缺点」一列。
- 中文提问
- 英文提问
| 方面 | 中文提问 | 英文提问 | 中英差异 | ||
|---|---|---|---|---|---|
| 提到 | 其中带缺点 | 提到 | 其中带缺点 | ||
| 显示与光学 | 100% | 78% | 100% | 79% | |
| 佩戴舒适与便携 | 100% | 51% | 100% | 35% | |
| 连接、兼容与软件生态 | 100% | 89% | 100% | 81% | |
| 空间定位与操控交互 | 99% | 63% | 100% | 65% | |
| 观影与娱乐体验 | 100% | 25% | 97% | 21% | |
| 办公与生产力 | 94% | 12% | 99% | 21% | |
| 品牌与公司 | 99% | 4% | 90% | 0% | 中文更常提 |
| 价格与性价比 | 81% | 33% | 72% | 14% | |
| 外观与社交接受度 | 63% | 2% | 78% | 36% | 英文更常提 |
| 近视与镜片方案 | 61% | 80% | 71% | 63% | |
| 续航与供电 | 43% | 87% | 56% | 48% | |
| 音频与通话 | 31% | 36% | 61% | 41% | 英文更常提 |
带缺点比例最高的方面是「连接、兼容与软件生态」:中文 89%、英文 81%。
表格视图
| 方面 | 中文提问 · 提到 | 95% 区间 | 其中带缺点 | 英文提问 · 提到 | 95% 区间 | 其中带缺点 | 中英差异 |
|---|---|---|---|---|---|---|---|
| 显示与光学 | 72/72 · 100% | 95%–100% | 78% | 72/72 · 100% | 95%–100% | 79% | — |
| 佩戴舒适与便携 | 72/72 · 100% | 95%–100% | 51% | 72/72 · 100% | 95%–100% | 35% | — |
| 连接、兼容与软件生态 | 72/72 · 100% | 95%–100% | 89% | 72/72 · 100% | 95%–100% | 81% | — |
| 空间定位与操控交互 | 71/72 · 99% | 93%–100% | 63% | 72/72 · 100% | 95%–100% | 65% | — |
| 观影与娱乐体验 | 72/72 · 100% | 95%–100% | 25% | 70/72 · 97% | 90%–99% | 21% | — |
| 办公与生产力 | 68/72 · 94% | 87%–98% | 12% | 71/72 · 99% | 93%–100% | 21% | — |
| 品牌与公司 | 71/72 · 99% | 93%–100% | 4% | 65/72 · 90% | 81%–95% | 0% | 中文更常提 |
| 价格与性价比 | 58/72 · 81% | 70%–88% | 33% | 52/72 · 72% | 61%–81% | 14% | — |
| 外观与社交接受度 | 45/72 · 63% | 51%–73% | 2% | 56/72 · 78% | 67%–86% | 36% | 英文更常提 |
| 近视与镜片方案 | 44/72 · 61% | 50%–72% | 80% | 51/72 · 71% | 60%–80% | 63% | — |
| 续航与供电 | 31/72 · 43% | 32%–55% | 87% | 40/72 · 56% | 44%–67% | 48% | — |
| 音频与通话 | 22/72 · 31% | 21%–42% | 36% | 44/72 · 61% | 50%–72% | 41% | 英文更常提 |
- 中文提问
- 英文提问
| 方面 | 中文提问 | 英文提问 | 中英差异 | ||
|---|---|---|---|---|---|
| 提到 | 其中带缺点 | 提到 | 其中带缺点 | ||
| 显示与光学 | 100% | 65% | 99% | 54% | |
| 佩戴舒适与便携 | 100% | 44% | 99% | 30% | |
| 连接、兼容与软件生态 | 100% | 69% | 99% | 68% | |
| 观影与娱乐体验 | 97% | 19% | 97% | 14% | |
| 办公与生产力 | 85% | 18% | 97% | 14% | 英文更常提 |
| 品牌与公司 | 100% | 8% | 82% | 0% | 中文更常提 |
| 空间定位与操控交互 | 81% | 62% | 86% | 66% | |
| 近视与镜片方案 | 81% | 22% | 78% | 16% | |
| AI 助手与智能功能 | 79% | 9% | 69% | 4% | |
| 外观与社交接受度 | 67% | 6% | 76% | 18% | |
| 音频与通话 | 50% | 19% | 75% | 37% | 英文更常提 |
| 拍照与录像 | 61% | 7% | 63% | 4% | |
| 价格与性价比 | 71% | 28% | 53% | 11% | 中文更常提 |
| 翻译与字幕 | 63% | 0% | 53% | 0% | |
| 续航与供电 | 57% | 78% | 54% | 51% | |
带缺点比例最高的方面是「连接、兼容与软件生态」:中文 69%、英文 68%。
表格视图
| 方面 | 中文提问 · 提到 | 95% 区间 | 其中带缺点 | 英文提问 · 提到 | 95% 区间 | 其中带缺点 | 中英差异 |
|---|---|---|---|---|---|---|---|
| 显示与光学 | 72/72 · 100% | 95%–100% | 65% | 71/72 · 99% | 93%–100% | 54% | — |
| 佩戴舒适与便携 | 72/72 · 100% | 95%–100% | 44% | 71/72 · 99% | 93%–100% | 30% | — |
| 连接、兼容与软件生态 | 72/72 · 100% | 95%–100% | 69% | 71/72 · 99% | 93%–100% | 68% | — |
| 观影与娱乐体验 | 70/72 · 97% | 90%–99% | 19% | 70/72 · 97% | 90%–99% | 14% | — |
| 办公与生产力 | 61/72 · 85% | 75%–91% | 18% | 70/72 · 97% | 90%–99% | 14% | 英文更常提 |
| 品牌与公司 | 72/72 · 100% | 95%–100% | 8% | 59/72 · 82% | 72%–89% | 0% | 中文更常提 |
| 空间定位与操控交互 | 58/72 · 81% | 70%–88% | 62% | 62/72 · 86% | 76%–92% | 66% | — |
| 近视与镜片方案 | 58/72 · 81% | 70%–88% | 22% | 56/72 · 78% | 67%–86% | 16% | — |
| AI 助手与智能功能 | 57/72 · 79% | 68%–87% | 9% | 50/72 · 69% | 58%–79% | 4% | — |
| 外观与社交接受度 | 48/72 · 67% | 55%–77% | 6% | 55/72 · 76% | 65%–85% | 18% | — |
| 音频与通话 | 36/72 · 50% | 39%–61% | 19% | 54/72 · 75% | 64%–84% | 37% | 英文更常提 |
| 拍照与录像 | 44/72 · 61% | 50%–72% | 7% | 45/72 · 63% | 51%–73% | 4% | — |
| 价格与性价比 | 51/72 · 71% | 60%–80% | 28% | 38/72 · 53% | 41%–64% | 11% | 中文更常提 |
| 翻译与字幕 | 45/72 · 63% | 51%–73% | 0% | 38/72 · 53% | 41%–64% | 0% | — |
| 续航与供电 | 41/72 · 57% | 45%–68% | 78% | 39/72 · 54% | 43%–65% | 51% | — |
- 中文提问
- 英文提问
| 方面 | 中文提问 | 英文提问 | 中英差异 | ||
|---|---|---|---|---|---|
| 提到 | 其中带缺点 | 提到 | 其中带缺点 | ||
| 拍照与录像 | 94% | 28% | 93% | 9% | |
| 显示与光学 | 88% | 38% | 99% | 30% | 英文更常提 |
| 佩戴舒适与便携 | 97% | 43% | 89% | 33% | 中文更常提 |
| AI 助手与智能功能 | 88% | 13% | 92% | 8% | |
| 音频与通话 | 85% | 46% | 90% | 26% | |
| 品牌与公司 | 83% | 20% | 90% | 15% | |
| 外观与社交接受度 | 78% | 23% | 94% | 25% | 英文更常提 |
| 连接、兼容与软件生态 | 81% | 48% | 90% | 40% | |
| 上市地区与服务可用性 | 69% | 98% | 96% | 99% | 英文更常提 |
| 翻译与字幕 | 78% | 2% | 86% | 5% | |
| 续航与供电 | 75% | 65% | 63% | 56% | |
| 价格与性价比 | 75% | 24% | 60% | 19% | |
| 近视与镜片方案 | 68% | 16% | 57% | 15% | |
| 空间定位与操控交互 | 42% | 10% | 79% | 12% | 英文更常提 |
带缺点比例最高的方面是「上市地区与服务可用性」:中文 98%、英文 99%。
表格视图
| 方面 | 中文提问 · 提到 | 95% 区间 | 其中带缺点 | 英文提问 · 提到 | 95% 区间 | 其中带缺点 | 中英差异 |
|---|---|---|---|---|---|---|---|
| 拍照与录像 | 68/72 · 94% | 87%–98% | 28% | 67/72 · 93% | 85%–97% | 9% | — |
| 显示与光学 | 63/72 · 88% | 78%–93% | 38% | 71/72 · 99% | 93%–100% | 30% | 英文更常提 |
| 佩戴舒适与便携 | 70/72 · 97% | 90%–99% | 43% | 64/72 · 89% | 80%–94% | 33% | 中文更常提 |
| AI 助手与智能功能 | 63/72 · 88% | 78%–93% | 13% | 66/72 · 92% | 83%–96% | 8% | — |
| 音频与通话 | 61/72 · 85% | 75%–91% | 46% | 65/72 · 90% | 81%–95% | 26% | — |
| 品牌与公司 | 60/72 · 83% | 73%–90% | 20% | 65/72 · 90% | 81%–95% | 15% | — |
| 外观与社交接受度 | 56/72 · 78% | 67%–86% | 23% | 68/72 · 94% | 87%–98% | 25% | 英文更常提 |
| 连接、兼容与软件生态 | 58/72 · 81% | 70%–88% | 48% | 65/72 · 90% | 81%–95% | 40% | — |
| 上市地区与服务可用性 | 50/72 · 69% | 58%–79% | 98% | 69/72 · 96% | 89%–99% | 99% | 英文更常提 |
| 翻译与字幕 | 56/72 · 78% | 67%–86% | 2% | 62/72 · 86% | 76%–92% | 5% | — |
| 续航与供电 | 54/72 · 75% | 64%–84% | 65% | 45/72 · 63% | 51%–73% | 56% | — |
| 价格与性价比 | 54/72 · 75% | 64%–84% | 24% | 43/72 · 60% | 48%–70% | 19% | — |
| 近视与镜片方案 | 49/72 · 68% | 57%–78% | 16% | 41/72 · 57% | 45%–68% | 15% | — |
| 空间定位与操控交互 | 30/72 · 42% | 31%–53% | 10% | 57/72 · 79% | 68%–87% | 12% | 英文更常提 |
- 中文提问
- 英文提问
| 方面 | 中文提问 | 英文提问 | 中英差异 | ||
|---|---|---|---|---|---|
| 提到 | 其中带缺点 | 提到 | 其中带缺点 | ||
| 品牌与公司 | 94% | 7% | 93% | 3% | |
| AI 助手与智能功能 | 86% | 14% | 92% | 6% | |
| 翻译与字幕 | 68% | 0% | 81% | 2% | |
| 连接、兼容与软件生态 | 68% | 31% | 72% | 21% | |
| 上市地区与服务可用性 | 54% | 100% | 69% | 90% | |
| 拍照与录像 | 44% | 3% | 71% | 4% | 英文更常提 |
| 音频与通话 | 36% | 15% | 67% | 4% | 英文更常提 |
| 显示与光学 | 35% | 36% | 53% | 18% | 英文更常提 |
带缺点比例最高的方面是「上市地区与服务可用性」:中文 100%、英文 90%。
上表的回答里,有 9 条把「阿里千问」当成千问大模型来介绍,没有谈眼镜(中文 5 条、英文 4 条),它们照常计入分母。在上面四个场景的 576 条回答里,提到阿里千问的中文回答 2 条、英文回答 0 条。
读法这款眼镜发布较晚,最可能的原因是这些模型的训练数据早于它的发布。这里测到的是模型的记忆里还没有这款产品,不能解读为模型不认可它。
表格视图
| 方面 | 中文提问 · 提到 | 95% 区间 | 其中带缺点 | 英文提问 · 提到 | 95% 区间 | 其中带缺点 | 中英差异 |
|---|---|---|---|---|---|---|---|
| 品牌与公司 | 68/72 · 94% | 87%–98% | 7% | 67/72 · 93% | 85%–97% | 3% | — |
| AI 助手与智能功能 | 62/72 · 86% | 76%–92% | 14% | 66/72 · 92% | 83%–96% | 6% | — |
| 翻译与字幕 | 49/72 · 68% | 57%–78% | 0% | 58/72 · 81% | 70%–88% | 2% | — |
| 连接、兼容与软件生态 | 49/72 · 68% | 57%–78% | 31% | 52/72 · 72% | 61%–81% | 21% | — |
| 上市地区与服务可用性 | 39/72 · 54% | 43%–65% | 100% | 50/72 · 69% | 58%–79% | 90% | — |
| 拍照与录像 | 32/72 · 44% | 34%–56% | 3% | 51/72 · 71% | 60%–80% | 4% | 英文更常提 |
| 音频与通话 | 26/72 · 36% | 26%–48% | 15% | 48/72 · 67% | 55%–77% | 4% | 英文更常提 |
| 显示与光学 | 25/72 · 35% | 25%–46% | 36% | 38/72 · 53% | 41%–64% | 18% | 英文更常提 |
- 中文提问
- 英文提问
| 方面 | 中文提问 | 英文提问 | 中英差异 | ||
|---|---|---|---|---|---|
| 提到 | 其中带缺点 | 提到 | 其中带缺点 | ||
| 拍照与录像 | 100% | 49% | 100% | 51% | |
| 音频与通话 | 100% | 29% | 100% | 44% | |
| 外观与社交接受度 | 100% | 6% | 100% | 10% | |
| 续航与供电 | 100% | 75% | 100% | 67% | |
| AI 助手与智能功能 | 99% | 34% | 100% | 14% | |
| 品牌与公司 | 100% | 4% | 97% | 6% | |
| 隐私与安全风险 | 93% | 79% | 96% | 84% | |
| 连接、兼容与软件生态 | 89% | 64% | 88% | 60% | |
| 近视与镜片方案 | 82% | 27% | 92% | 23% | |
| 翻译与字幕 | 83% | 7% | 86% | 5% | |
| 价格与性价比 | 85% | 49% | 74% | 26% | |
| 显示与光学 | 74% | 83% | 75% | 76% | |
| 上市地区与服务可用性 | 97% | 100% | 51% | 89% | 中文更常提 |
| 佩戴舒适与便携 | 81% | 24% | 60% | 28% | 中文更常提 |
| 做工、稳定性与售后 | 47% | 50% | 50% | 50% | |
带缺点比例最高的方面是「上市地区与服务可用性」:中文 100%、英文 89%。
表格视图
| 方面 | 中文提问 · 提到 | 95% 区间 | 其中带缺点 | 英文提问 · 提到 | 95% 区间 | 其中带缺点 | 中英差异 |
|---|---|---|---|---|---|---|---|
| 拍照与录像 | 72/72 · 100% | 95%–100% | 49% | 72/72 · 100% | 95%–100% | 51% | — |
| 音频与通话 | 72/72 · 100% | 95%–100% | 29% | 72/72 · 100% | 95%–100% | 44% | — |
| 外观与社交接受度 | 72/72 · 100% | 95%–100% | 6% | 72/72 · 100% | 95%–100% | 10% | — |
| 续航与供电 | 72/72 · 100% | 95%–100% | 75% | 72/72 · 100% | 95%–100% | 67% | — |
| AI 助手与智能功能 | 71/72 · 99% | 93%–100% | 34% | 72/72 · 100% | 95%–100% | 14% | — |
| 品牌与公司 | 72/72 · 100% | 95%–100% | 4% | 70/72 · 97% | 90%–99% | 6% | — |
| 隐私与安全风险 | 67/72 · 93% | 85%–97% | 79% | 69/72 · 96% | 89%–99% | 84% | — |
| 连接、兼容与软件生态 | 64/72 · 89% | 80%–94% | 64% | 63/72 · 88% | 78%–93% | 60% | — |
| 近视与镜片方案 | 59/72 · 82% | 72%–89% | 27% | 66/72 · 92% | 83%–96% | 23% | — |
| 翻译与字幕 | 60/72 · 83% | 73%–90% | 7% | 62/72 · 86% | 76%–92% | 5% | — |
| 价格与性价比 | 61/72 · 85% | 75%–91% | 49% | 53/72 · 74% | 62%–82% | 26% | — |
| 显示与光学 | 53/72 · 74% | 62%–82% | 83% | 54/72 · 75% | 64%–84% | 76% | — |
| 上市地区与服务可用性 | 70/72 · 97% | 90%–99% | 100% | 37/72 · 51% | 40%–63% | 89% | 中文更常提 |
| 佩戴舒适与便携 | 58/72 · 81% | 70%–88% | 24% | 43/72 · 60% | 48%–70% | 28% | 中文更常提 |
| 做工、稳定性与售后 | 34/72 · 47% | 36%–59% | 50% | 36/72 · 50% | 39%–61% | 50% | — |
方法:两种点名问法,中文「介绍一下{品牌}的智能眼镜。」「{品牌}的眼镜怎么样?」;英文独立撰写:"Tell me about {brand}'s smart glasses." "What are {brand} glasses like?"。{品牌} 处中文问法写品牌的中文名,英文问法写英文名。每个品牌每种语言 2 种问法 × 3 次 × 12 个模型 = 72 条回答,面板与采集时间同上。每条回答逐句归到冻结的码本 v1 的 18 个方面(另有「其他」),码本 sha256 前 12 位 ebffb8ae97c3。「提到」= 至少一句谈到该方面的回答占比,区间为 95% Wilson 区间,见表格视图;「其中带缺点」= 这些回答里至少有一句负面陈述的占比,谈到该方面的回答少于 20 条时不报。「中英差异」只在两侧都至少 20 条时做两比例检验,p < 0.05 才标出。信度:随机抽取 336 条回答由第二位编码员独立再编,19 个代码的 Cohen's κ 在 0.87 到 0.98 之间,负面判断一致率 97.2%。
后续样例
提及率变化样例
数据采集中同一组冻结的问题、深度采样的两期数据,逐格给出三档判定。两期都采集完成后放在这里。
本页的汇编数据(名次、模型覆盖、提及比例、区间、变更断点)以 CC BY 4.0 许可发布,引用时请注明 ask10ais 与测量日期。模型原始回答的权利归各模型提供方,我们只是原样保存,供人核验。
本记录测量的是大语言模型在某一时刻对某一问题的输出,不是对产品质量、市场份额或企业资质的评价。模型输出可能包含错误或虚构信息;本记录如实保存模型的原始返回,不代表我们认可其内容。本记录不构成投资建议或采购建议。