最後更新:
香港深圳交通時間指數方法、樣本量及匿名資料說明
一句話答案:正式版建議採集 2,400 個有效事件,其中 1,600 個口岸實測及 800 個機場接送事件,覆蓋工作日、週末及至少 4 個展會日,並以隨機事件 ID 和 15 分鐘時間粒度保護私隱。
建議樣本量及採集週期
| 模組 | 建議樣本量 | 分層方式 |
|---|---|---|
| 四個陸路口岸 | 1,600 | 每個口岸約 400 個完整車輛事件 |
| 香港機場接送 | 800 | 航班落地偏差、接機/送機、時段及車型 |
| 合計 | 2,400 | 去重後只保留時間戳完整的有效事件 |
建議採集週期為 2026-09-01 至 2026-12-31,至少覆蓋工作日、週末及 4 個可核對日期的展會日。若預算有限,應先確保每個口岸和日期類型都有最低樣本量。
指標、清洗及匿名化
- P50/P90 只在同一口岸、方向、日期類型或機場場景的有效完成事件上計算;
- 口岸時間由第一個排隊點至完成兩地查驗並駛離口岸場站;道路接駁另外統計;
- 去除重複事件、時間倒序、明顯跨日錯誤及未完成行程;
- 至少抽取 5% 事件人工覆核,並保存資料版本、樣本量、採集週期及指標腳本版本;
- 使用隨機事件 ID,不保存姓名、電話、微信、WhatsApp、完整訂單號、車牌、司機姓名或航班號;
- 對外時間取整到 15 分鐘,小樣本分組不發佈精確值。
正式發佈前的三道門檻
- 定義凍結:寫清開始點、結束點及 P50/P90 分組規則;
- 樣本可覆核:每個公開數字都能回溯至匿名事件 ID 和清洗狀態;
- 來源分層:官方背景資料、內部實測資料及示例資料不能混寫。
延伸問題
為甚麼不直接用口岸旅客流量計算通關時間?
旅客流量說明規模及高峰背景,但不能直接給出車輛排隊、兩地查驗及離場所需分鐘數;時間指數需要有開始及結束時間的行程事件。
2,400 個樣本是否足夠代表全年?
這是建議試行規模,不是統計代表性的自動保證。正式報告要同時說明各分層覆蓋、樣本量及不確定性。
匿名化後還可以做調度復盤嗎?
可以。調度復盤只需保留隨機事件 ID、時間區間、路線維度及清洗狀態,原始資料的存取權限應與公開報告分開。
資料來源及界線
本頁是正式採集方案及治理建議,不代表已完成 2,400 個事件的實測。最後更新:2026-08-19。
聯絡我們
WhatsApp:+86 185 6578 2342
WhatsApp 备用:+852 6662 8332
WeChat:623040732
Line:+852 6825 4021
Email:guilicheng613@gmail.com