数据能被复核才有意义。这一页把我们的采集口径完整摊开——哪些模型、怎么采、指标怎么算,以及我们不做什么、暂不公开什么。更新日期:2026-10-08。
逐条写死具体版本号,不用模糊别名长期跑;每季度复核一次 C 端默认模型是否升级。
| 模型 | 厂商 | 当前版本 |
|---|---|---|
| 豆包(快速模式) | 字节跳动 | doubao-seed-2-0-mini-260428 |
| DeepSeek | 深度求索 | deepseek-v4-1-flash-260910(经火山方舟托管接入) |
| 千问 | 阿里 | qwen3.7-max |
| 文心 | 百度 | ernie-5.1 |
| Kimi | 月之暗面 | kimi-k2.6 |
以下是我们自己实测中得出的两条结论,都带时间窗与样本量,机构名按授权范围匿名处理。
两周内被 AI 引用 215 次,覆盖 27 篇文章与 15 个问题;引用来源集中在单一平台
结论:不能用单一平台的数据推断整体 AI 可见度;监测须覆盖多个平台并单列来源分布
提及率分别为 6.9%(两周同站对比升至 20% 以上)与 47.2%(670 次采集、316 次提及)
结论:提及率只说明有没有被讲到;还必须看信息准确度,报告固定给出「提及率 + 信息变形清单」
具名机构与逐项数据在客户案例页——那两家机构已书面同意我们使用其名称与实测数据。
写出来是为了避免「没写 = 不确定」被随意发挥——这些不是没有,是有原因地不放。
A:当前纳入 5 个:豆包(快速模式)、DeepSeek、千问、文心、Kimi。逐条写死版本号,季度复核一次是否升级。豆包专家模式(长思考)按我们的监测规则不纳入常规采集;元宝因接口稳定性问题暂停纳入,恢复后会更新本页与事实文件。
A:一条样本 = 一个模型 × 一条问法 × 一次回答。同一条问法可以配置重复采样 1~5 次(默认 1 次),重复时取多数结论,用来压低单次回答的随机抖动。报告里的样本量就是按这个口径数的。
A:报告标注采集平台、问法原文、样本量与时间窗,客户可以按同样的问法、同样的时间窗自己跑一遍对照。凡是不能这样复核的数字,我们不写进对外内容。
A:客户机构名称与逐项实测数据的对应关系;报价与合同条款;办公地址;工商公示以外的资质证书清单。原因写在 /methodology 页面与本页正文里。