01
数字
| 2026-08-01 | 2026-10-01 | |
|---|---|---|
| 被提及 —— 两次都测了的 9 个助手 | 7.3% | 21% |
| 被提及 —— 西方助手 | 11% | 33.6% |
| 被提及 —— 中文助手 | 2.6% | 5.1% |
| 官网被引用 —— 西方助手 | 10.5% | 33.6% |
22 个不含品牌名的买家问题,每个助手每题问两遍。 基线: 首次定时测量;9 个助手里 6 个部分超时.
分助手明细,以及哪些要打折看
这次跳升只出现在一次测量里:Gemini 在 09-16 到 10-01 之间从 2.3% 跳到 68.2%,之前三次分别是 14.1、9.3、10.6。11 月复测前别拿它当结论。
| 助手 | 2026-08-01 | 2026-10-01 |
|---|---|---|
| ChatGPT | 9.1% | 45.5% |
| Perplexity | 25% | 50% |
| Claude | 0% | 4.5% |
| Gemini | 2.6% | 68.2% |
| Grok | 18.2% | 0% |
| 豆包 Doubao | 0% | 0% |
| 通义千问 Qwen | 0% | 0% |
| DeepSeek | 0% | 0% |
| Kimi | 10.5% | 20.5% |
比率是两次都测了的助手各自比率的简单平均;后来新增的助手两边都不算。引用只算西方助手 —— 中文接口不返回来源列表。
02
我们做了什么
- Wikidata 条目配第三方引用;IMDb 署名经 sameAs 关联。
- /proof 证据页,每条声明都能点开核实;/about 加纸刊报道和署名特写。
- 公开价格,并为中文问题新建中文费用页。
- Clutch 与 models.com 档案;www 301 到主域。
03
还弱在哪
中文助手:只有 Kimi 提到(20.5%),豆包、通义、DeepSeek 都是 0。Grok 从 8 月的 34.1% 掉到 0。