← 全部分析

通义千问自己的模型被问到"AI 眼镜品牌"时,也没提到千问

发布于 2026/09/05

2026-09-03 的复测里,千问/夸克在 12 个大模型的回答中仍是 0 次提及;我们同时核实了一个此前没写过的事实——千问眼镜其实是独立于夸克 S1 的第二款产品。

分享
下载图片(含二维码)分享到 X分享到 LinkedIn

微信:保存图片后在聊天里长按识别二维码。

为什么又写一次千问

我们在上一篇文章里报告过:2026-09-02 的那次测量中,"千问""夸克""Qwen""Quark"这几个写法在 12 个模型的回答里命中 0 次。这次不是重复那个结论,而是两件新事:一是我们对同一个题目做了品牌归一化修复后的复测(本文引用的是 2026-09-03 10:27:35 这次 run,不是上一篇引用的那次);二是我们核实清楚了一个此前没写过的事实——"千问眼镜"并不是"夸克 AI 眼镜"改了个名字,而是阿里巴巴在 2026 年 3 月另外发布的第二款产品。这两件事放在一起,比单看"提及率是 0"更值得说清楚。

测量结果快照

在 2026-09-03 10:27:35 的这次测量中,中文提问面板 31 个候选品牌里,"千问""夸克""Qwen""Quark"四个写法命中 0 次;英文提问的同一次复测(25 个候选品牌)同样是 0 次。前三位分别是 Rokid(66.19)、Meta(63.64)、小米(54.66),千问不在候选名单里——不是排名靠后,是完全没被任何模型提到。

值得单独指出的一条:这次面板里包含阿里巴巴自己的模型 qwen/qwen3.8-max。它在中文提问下给出的十个品牌是 Ray-Ban、Meta、Xreal、Rokid、雷鸟创新、INMO、李未可、华为、小米、Even Realities——这十个里没有千问,也没有夸克。我们只报告这条原始返回记录,不对"为什么"做推测。

观察一:换了名字,但记忆没跟上——这不是同一个品牌的两次发布

以下这段关于产品发布时间线的信息,我们引用自公开报道,未做独立核实,仅供参考。据南华早报(SCMP)2026-02-28 的报道,阿里巴巴 2025 年 11 月发布的是"夸克 AI 眼镜",2026 年 3 月 2/3 日在 MWC 巴塞罗那另外发布了名为"千问眼镜"(Qwen Glasses)的产品线,报道称这是阿里巴巴"第二次"进入智能眼镜市场,两款是先后独立发布的两条产品线,不是同一产品换了名字。

这个时间线能部分解释、但不能完全解释"零提及":本次面板里公开的几个头部模型训练截止时间集中在 2026 年 1 到 3 月,"千问眼镜"这个名字确实是在多数模型完成训练之后才启用的,用"太新"能说得通。但"夸克"这两个字从 2025 年 11 月就在使用,同样是 0 次——这一点用"名字太新"解释不了。

观察二:第三方出货份额与我们测量的提及率之间,缺口没有缩小

以下市场份额数据引用自第三方机构 CINNO Research 的公开发布,我们只做引用,未做独立核实,口径与准确性以发布机构为准。CINNO 统计 2026 年一季度中国 AI/AR 眼镜市场份额,前五位依次是雷鸟 24%、Rokid 20%、XREAL 14%、千问 11%、小米 7%——按这份第三方数据,千问的出货份额已经排在小米之前。

把这两组数字并排放:Rokid 和 XREAL 在 CINNO 的出货份额榜和我们的提及率测量里都进了前五;千问在出货份额榜进了前五,在提及率测量里是 0/31。两组数据的口径完全不同(一个是电商/渠道出货统计,一个是模型训练语料的记忆测量),不能相互印证或替代,我们也不判断哪一组"更准"——只是把这个缺口如实摆出来。

局限

本次测量的面板完整度为 93.1%(中文)/ 100%(英文),7 个头部模型 + 若干长尾模型参与打分,权重来源见方法论页。归一化健康度为 ok。需要提醒的是,本站的评估模型面板本身也包含大语言模型,而这类模型的训练语料可能包含其他 AI 榜单/测评的历史结果,存在"自反污染"的可能——即模型对某个品牌的印象部分来自它曾经被别的榜单提及,而不完全是独立判断。这是当前方法论的已知局限,不是这次测量特有的问题。

另外两条局限单独说明:一是 SCMP 的产品发布时间线报道与 CINNO 的出货份额数据均为第三方发布,我们未做独立核实;二是"零提及"不是对千问眼镜产品本身的评价,也不是对阿里巴巴营销策略的评价,它只说明模型训练语料在截至目前的构成。

完整方法论、每一条模型原始返回和归一化记录见 方法论页完整榜单。此前两篇相关文章:AI 眼镜:七个模型都把 Ray-Ban 放最前,聚合后它却排第四中国线上卖得靠前的 AI 眼镜里,有一个牌子被 12 个模型提到了 0 次

这篇文章引用的那次测量

AI 眼镜

观测于 2026/09/03 · 12 个模型 · 面板完整度 93%

  • 1Rokid66.19
  • 2XREAL65.09
  • 3Meta63.64
  • 4小米Xiaomi58.41
  • 5华为54.39
  • 6Ray-Ban48.01
  • 7RayNeo34.41
  • 8INMO27.50
  • 9Amazon18.39
  • 10Snap15.78

这份快照冻结在上面这一次测量上,后续重跑不会改写它;榜单页显示的始终是最近一次。

查看完整榜单 →