地理位置与流量质量
省/州、带坐标的城市、网络与运营商、访客类型,以及按访客自己钟表计算的活跃度——还有哪些会被保存、哪些不会,以及数据从哪里来。
更新于 2026年8月14日
在国家/地区图表之外,还有五份明细,回答国家/地区图表回答不了的问题:具体在哪里、来自哪个网络、那些流量质量如何,以及发生在访客自己一天中的第几个小时。
详细的地理数据和流量质量面板是付费功能。当套餐不包含它们时,这些面板会被替换成升级提示,底层接口返回的是套餐限制,而不是空数据。
五份明细
省/州。 行政区划代码、GeoNames 标识、点击量和独立访客。正是这个标识,让「Bavaria」和「Bayern」并成一行,而不是分成两行。
带坐标的城市。 每座城市都带一个坐标点和一个精度半径。请务必读一下这个半径:一个半径二十公里的点描述的是一个地址段,而不是某个人。
网络。 自治系统号、运营商名称、该地址段的地址类型,以及分列两栏的总点击量和真人点击量。这两栏之间的差距,通常就是全部故事所在。
流量质量。 按访客类型、地址类型和质量评分区间拆分的访问量。
本地小时。 按点击发生那一刻访客自己时区的小时数统计的活跃度。这个值在事件写入时就算好,因为存储引擎只能转换到某一个固定时区,而这里的每一行时区都不一样。
这里是故意统计爬虫的
即使打开了「排除爬虫」,仍有三份明细包含自动化流量:已过滤流量、流量质量和网络。把爬虫从它们里面剔掉,恰恰会清空你正是为了看爬虫才打开的那几块面板。
在其他任何地方,「排除爬虫」筛选器的行为一如既往;而且自动化流量从不消耗套餐的跟踪点击量额度。
地名跟着读者走
事件保存的是标识,从不保存本地化后的名称。名称是在读取报告时,从读者自己语言的词典里解析出来的——所以同一行存下来的数据,在一位同事那里读作「Berlin」,在另一位同事那里读作「Берлин」。
控制台的十种语言里有八种提供地名。意大利语和韩语会回退到英文名称,而不是留下空白单元格。词典留在服务端:它们有好几兆字节,这类东西不会被发送到浏览器。
语言取自你的账号设置,而不是请求参数。如果用参数指定,某个人就能把别人的语言钉进整个工作区共享的缓存里。
哪些会保存,哪些不会
- 访客的 IP 地址不会被保存。它只在一个函数内部存在足够长的时间,用来生成当天的指纹——一个每晚轮换的加盐哈希——以及查询地址段。
- 邮政编码由数据库解析出来,但被刻意不记录:在住宅密集的地方,邮政编码已经很接近一个门牌号了。
- 坐标以万分之一度为单位、按整数保存。多余的小数位只会营造出一种并不存在的精确感。
- 每一行都会记下是哪个数据源回答的,因此图表绝不会悄悄把精确数据和近似数据混在一起。
地理数据包不可用时
跳转照常工作,数据分析照常记录。解析器会回退到 CDN 本来就提供的位置数据,并相应地给这些行打上标记。这类行缺少城市标识和精度半径,界面上也会说明它们的名称没有本地化。
数据来源与署名
位置结果来自获得授权的商业数据库,并被打包成一种为 edge 查询而设计的格式。原始数据库文件从不公开、不再分发、也不随应用一起分发:离开基础设施的只有关于某个具体地址的派生结果。
城市和省/州的名称来自 GeoNames 地理数据库,依据 Creative Commons Attribution 4.0 许可协议使用。该许可协议要求署名,这一署名同时也发布在隐私页面上。
地址段类型的结果——数据中心、VPN、公共代理、TOR、网页匿名代理——来自一个商业 IP 情报数据库,条款相同:在服务内部使用是被许可的,再分发该文件则不被许可。
控制详细程度与保留期
上面这一切都是可以设置的,位置在设置 → 访客数据与隐私:
| 级别 | 保存的内容 | | --- | --- | | 完整 | 国家/地区、省/州、城市、坐标、精度半径、时区、本地小时 | | 城市但不带坐标 | 国家/地区、省/州、城市、时区、本地小时 | | 仅国家/地区 | 国家/地区和大洲 |
访客的网络、完整的来源页地址和流量类型识别,各由单独的开关控制。保留期是写进每个事件里的天数:到期时由存储引擎删除该行——这和套餐限制你能往回看多久是两回事。
改动其中任何一项,都会在几秒之内对新的点击生效——设置会立即推送到每一条链接和每一个页面的 edge 缓存,而不是等到下一次缓存过期。