← 回到文章

IDAEO 數據專欄 · 圖表附錄

7 張延伸圖表

這些圖補充正文,但不是理解主論點的必要條件;獨立成頁,避免正文重複載入與敘事過長。

所有數據 as-of 2026-07-12。單一台日新聞平台供給側觀察;可識別導流以 referer 計,屬下限;相關不等於因果;異口徑快照不可當同儀器趨勢。
累計 30,788,387 次請求由五段不重疊窗口組成。
標題口徑。3,078 萬不是單一 30 天窗口,也不是全部都屬訓練型;五段窗口與分類已逐項列出。
30 天爬蟲組成,訓練型占 76.9%。
30 天組成。殘差 15,609 次包含 10,403 次未分類與 5,206 次查詢時點差。
每筆可識別 AI 導流所對應的同窗抓取次數。
同窗計數比,不是轉換率。request 與可識別導流沒有逐事件 attribution;referer 缺失也會改變比值。
英文與中文可識別 AI 導流為 204 對 9,約差 22.7 倍。
英中可識別導流差距。中文只有 n=9,對單筆變動敏感;不能把 22.7 倍解讀成新增英文版必然帶來的成效。
ChatGPT-User、OAI-SearchBot 與 PerplexityBot 的日英中抓取量矩陣。
三隻引用型 UA 的語言抓取分布。這是本平台 request 觀察,不代表所有 AI 引擎或最終回答層。
文章提出的三個行動假說:機器可讀英文版、保留日文價值、檢查 robots 是否誤擋。
行動假說,不是成效承諾。應先重跑自站日誌,再用 matched-content 或 A/B 實驗驗證。
六條資料限制:下限、語言、外推、因果、口徑與樣本。
六條限制。公開雜湊只證明 artifact integrity;source truth 與 clean-room aggregate reproduction 尚未獨立見證。