Methodology

测试方法与评分规则

公开测试条件、原始记录与缺失数据,避免把少量样本包装成长期结论。

Who tests

测试者与内容作者

本站测速及 ChatGPT、流媒体使用体验测试,均由 siilas 本人完成。

siilas专注于机场节点在真实使用中的表现。测试者同时也是机场服务的实际用户,通过持续使用和复测不同机场、地区节点与客户端,为其他用户选择更合适的机场提供可复查的真实参考。

测试结果只代表记录时间、测试网络和对应节点下的实际表现,不保证所有地区、运营商或时间段都能得到相同结果。查看

Test setup

测试环境

本地网络

中国北方联通 1000M 宽带

实际结果同时受本地网络、节点负载、跨境线路和 Speedtest 目标服务器影响。

测试设备

MacBook

在同一主要设备上进行测试,减少设备性能和网络配置差异带来的额外变量。

测试客户端

机场专属客户端和 FlClash

按机场实际支持情况选择,客户端信息尽量随每条原始记录保留。

测试时段

全天不定时

每条记录保留日期与时间。样本充足后再单独比较日间和晚高峰。

Raw data

记录规则

速度

记录下载、上传及 Speedtest 结果链接;不从套餐标称带宽推算实测速度。

可用性

ChatGPT 与流媒体分别记录、分别计分,互不影响。香港节点按当前实测统一标为 ChatGPT 不可用;流媒体统一采用 4K 视频缓冲时间五档制。

延迟与实际体验

测速截图能确认延迟时才记录。以后不再要求采集抖动和丢包:单次 Speedtest 的这两项容易受到测速服务器、瞬时线路和当时拥塞影响,对机场长期使用体验的参考价值有限。本站主要通过同地区节点跨日期复测的速度波动,以及 ChatGPT 和流媒体体验判断实际表现。

Scoring

何时显示评分

参评条件:新加坡、香港、日本和美国四类常用节点均有至少一条已验证测速样本后,即可自动计算并显示评分,不限制连续测试天数或累计样本数量。

已验证测速样本包括带结果链接的原始测速,以及有客户端截图佐证的网络质量补充测试。节点在线快照和服务异常观察单独归档,不计入评分。

地区覆盖不完整时,稳定性与综合评分显示“数据积累中”;ChatGPT 和流媒体是独立体验子项,只要存在符合状态规则的实测记录,就会先自动换算并显示百分制平均分。样本较少时,单次结果对分数影响更大,新增记录后分数会持续更新。

自动评分:稳定性 40%、速度 25%、ChatGPT 可用性 15%、流媒体体验 10%、套餐性价比 10%。所有测速先按“地区+日期”汇总:同一地区同一天多次测速取中位数,避免某一天因测试次数更多而获得额外权重。稳定性比较每日代表速度的跨日期波动;速度比较四个地区的每日代表下载速度;ChatGPT 与流媒体先计算地区内每日体验,再让已有实测的地区等权;性价比按标准月付套餐的月流量与月费换算,10GB/元达到该项满分。不限时流量包、加油包与私人专线单独展示,不混入性价比计算。最终综合评分为 10 分制,保留一位小数。

为降低单次异常值的影响,速度和同日汇总采用中位数。抖动与丢包不作为本站采集或评分指标。

Score conversion

稳定性与可用性如何计分

稳定性分数

分别汇总新加坡、香港、日本和美国四个地区的跨日期测速。同一地区同一天存在多条记录时,先分别取下载和上传中位数,形成当天的代表值;再使用变异系数(标准差 ÷ 平均值)衡量每日代表速度的波动。波动越小,稳定性越高;某天速度明显下降,会直接拉低该地区得分。

单地区分数 = 下载一致性 × 80% + 上传一致性 × 20%,其中一致性 = 100 − 变异系数 × 100,并限制在 0–100 分。总稳定性为四个地区分数的等权平均值,每个地区各占 25%。

同地区测试会尽量使用相同节点、客户端、本地宽带和 Speedtest 服务器。现阶段部分历史记录只能按地区归组,因此该分数更准确地表示“跨时间速度一致性”,不等同于全年在线率。低速和失败记录不会被删除。

ChatGPT 分数

ChatGPT 首字响应体验与分数换算
首字响应时间标准状态单条得分
≤ 5 秒流畅100
> 5 秒且 ≤ 10 秒轻微延迟75
> 10 秒且 ≤ 20 秒响应较慢50
> 20 秒且 ≤ 40 秒响应严重延迟25
> 40 秒、无法回答或页面打不开不可用0

使用同一账户、模型和固定短问题,从点击发送计时到出现第一个回答文字。每个节点连续测试 3 次,取首字响应时间中位数计分。同一地区同一天多条记录先求平均,再计算该地区跨日期平均分;最后让已有实测的各地区等权,避免测试次数多的地区主导结果。

流媒体分数(4K)

4K 流媒体缓冲体验与分数换算
最长缓冲时间标准状态单条得分
≤ 5 秒流畅100
> 5 秒且 ≤ 10 秒轻微缓冲75
> 10 秒且 ≤ 15 秒缓冲明显50
> 15 秒且 ≤ 20 秒缓冲严重25
> 20 秒或无法播放不可用0

固定使用同一 4K(2160p)视频,记录首次播放以及拖动至 25%、50%、75%位置后的恢复播放时间,取其中最长一次计分。每个节点至少播放 60 秒。同一地区同一天多条记录先求平均,再计算该地区跨日期平均分;最后让已有实测的各地区等权。

进入综合评分的权重:稳定性分数占 40%,ChatGPT 分数占 15%,流媒体分数占 10%。这里展示的都是百分制子项,按权重与速度、性价比合并后,再换算成首页所见的 10 分制综合评分。

历史状态归档:采用计时规则前的 ChatGPT 与流媒体文字记录按原含义映射到最接近的五档状态,不补写不存在的精确秒数;新记录必须按上述计时方法提交。

状态校验:新提交的 ChatGPT 或流媒体状态必须属于上表已有规则。出现未定义措辞时会先提示确认,不直接写入,也不会自动给予分数。

所有分数都会随新增实测记录自动重新计算,因此同一家机场的分数可能随着不同时段和不同节点的表现上升或下降。

Disclosure

复核与商业独立

可复查

有公开结果页的测速记录会保留链接;套餐和运营信息注明更新时间并持续复核。

不补造数据

未测项目显示为空或待复核,不沿用宣传页结论生成评分。

推广不改权重

页面可能含推广链接,但合作状态不改变原始记录、参评条件或排行榜权重。

查看全部机场测速记录 →当前机场排行榜 →,可将这里的规则与实际样本、评分结果交叉复核。