KääseläKaasela Kamogawa AI Search Lab

Monthly Report #000
京都體驗類別中生成式AI的回答傾向(2026年7月)

——3類別×4語言・240次觀測的基準線

2026年8月2日 | Kääselä(Kamogawa AI Search Lab)

1. 摘要

本報告向 ChatGPT 用四種語言各問了 20 次京都「茶道」「和服」「坐禪」的推薦,並記錄回答中引用的資訊來源(共 12 格・240 次觀測)。

分析發現,AI 引用哪個資訊來源存在一致的規律,這個規律主要與兩個因素對應。

一是該類別是否有足夠的市場,足以支撐比較網站或聯盟行銷站的存在;二是該語言中這類資訊來源是否已經建立、且 AI 能夠觸及。

這兩個條件都成立的格子裡,AI 較常引用比較類媒體;缺其中一個的格子裡,則較常引用商家自己的官網。不過本期是單一時點、單一引擎的橫斷觀測,這種對應關係只是與觀測規律吻合的假說性解釋,並未證明因果關係。

第 0 號(本期)用於確立觀測方法與評估指標,是基準線。此後每月的報告會以本期為起點(t=0),持續追蹤這個結構如何變化。

2. 方法

本調查使用 ChatGPT(GPT-5.5・網頁版),於暫存對話/登出狀態下執行。

以「京都+類別詞+推薦詞」作為基本查詢語,以日語、英語、簡體中文、繁體中文四種語言觀測。目標類別為「茶道」「和服租借」「坐禪」三類。

每條查詢連續執行 20 次(n=20),記錄回答中出現的商家名稱與引用網域,並同時記錄執行時間、執行地點(京都市)、網路環境、模型名稱。

引用來源分為「公共」「自營」「OTA」「媒體」「目錄」「UGC」六類。記錄以門市為單位,彙總以品牌為單位。

此外,我們事先確認過,關鍵字型提問(例如「京都 茶道體驗 推薦」)與自然語言型提問,在返回的商家上沒有顯著差異,因此本調查統一採用關鍵字型。

原始資料以 data.csv 公開(CC BY 4.0・無償公開・不販售)。

適用範圍:本報告僅涵蓋推薦型查詢的回答。比較型、交易型、指名型等不同的搜尋意圖下,引用來源可能不同。

本期是單一時點的觀測結果(t=0),不討論變化或趨勢,這些將自第 1 號起以月度資料分析。

此外,本調查的對象僅限於 ChatGPT(GPT-5.5)、單一觀測者、單一執行地點,結果不能直接推廣至其他生成式 AI 或不同的執行條件。

第 3 章中關於「類別商業性」「語言條件」「自我描述能力」之間對應關係的解釋,是與觀測規律吻合的假說性解讀,並不能證明因果關係。

本報告會先說明上述適用範圍,再解讀結果——這也是本調查的基本立場:不從單次回答(n=1)推導出普遍結論,而是根據一定數量的觀測結果評估傾向。

3. 引用來源分布

3.1 12格的引用來源主導類型(占比 %)

日語英語簡體中文繁體中文
茶道公共 52.2媒體 46.0(次位:自營40.0・差6pt)自營 40.6(次位:公共37.5・差3pt)自營 56.8
和服媒體 53.7媒體49.1+OTA30.9≈80自營 54.8自營 66.7
坐禪公共50.0+目錄23.5自營80.2自營49.5(次位:公共35.2・差14pt)自營43.4(次位:公共40.4・差3pt)

(各格 n=20。分類標準見方法論附錄。「次位」為與第二名類型的差距。)

表 3.1 可以讀出三個共通的傾向。

第一,類別的商業性越高,比較類媒體越容易被引用。像和服這樣容易形成比較網站或聯盟行銷的類別,比較類媒體是引用的中心;而以免費坐禪會為主的坐禪類別,幾乎看不到這類資訊來源,公共網站或提供者自己的官網才是中心。

第二,不同語言下 AI 能參考的資訊來源不同。日語、英語的和服市場已存在一定數量的比較類媒體,AI 也會引用它們;茶道類別在各語言中比較類媒體都很少,因此政府觀光網站、旅遊媒體成為引用中心。

第三,當比較類媒體不夠充分時,官網更容易被引用。這個傾向在中文圈與坐禪類別中尤其明顯。

中文圈共通的特徵:簡體中文與繁體中文合計 6 格中,所有類別皆是自營網站被引用最多,沒有任何一格是公共網站或比較類媒體居首。

不過這個優勢的大小因類別而異。和服類別中,簡體中文(自營54.8%・公共17.8%)與繁體中文(自營66.7%・公共10.4%)都是自營網站大幅領先;而茶道與坐禪的差距較小——茶道(簡體)與坐禪(繁體)都是約 3 個百分點的勢均力敵,坐禪(簡體)差 14 個百分點,茶道(繁體)差 32 個百分點。「簡體勢均力敵、繁體占優」這種簡單二分法無法解釋這個現象。

3.2 案例1:日語的和服類別,引用集中於單一聯盟行銷站

「京都 着物レンタル おすすめ」的查詢中,一個排名類網站(2025年開設,觀測時約營運15個月)在20次執行中被引用了18次(90%)。僅此一站,就占了「媒體」類型(53.7%)的大半,政府觀光網站的引用相對較少。

這個結果顯示,AI 時代的能見度,可能會集中在某個專門做特定目的比較的媒體站上。我們將把這個排名網站份額的變化,作為和服類別今後持續追蹤的主要指標。

3.3 案例2:即使以中文提問,也未引用中國系平台

簡體與繁體中文合計 6 格中,小紅書、馬蜂窩、攜程、大眾點評、微博、知乎等中國系平台一次都沒有被引用。

即使以中文提問,AI 引用的仍是日本一方的官網、商家的中文頁面,部分還參考了英文的 Reddit。也就是說,中文使用者以 AI 查詢時,主要接收到的並非中文圈自身的資訊,而是來自日本一方的資訊。

3.4 案例3:簡體中文中還有一項暫時無法解釋的觀測

不過,僅憑上述規律無法解釋一項觀測。簡體中文中,除了中國系平台以外,還存在 AI 理論上可以參考的比較文章、排名文章(例如一般媒體做的和服租借專題)。

但實際上,簡體中文的和服類別中,自營網站(54.8%)與公共網站(17.8%)是引用的中心,這類比較類媒體並未成為引用主流。「因為中國系平台不被引用,所以比較類媒體也不被引用」這個說法無法完全解釋此現象。

目前無法確定原因,本報告在此保留結論,作為今後持續觀測的課題。

3.5 案例4:坐禪類別中,提供者自身的資訊最常被引用

坐禪類別中,所有語言下,寺院等提供者自身的官網或公共網站皆為引用的中心,OTA 與聯盟行銷幾乎不存在。尤其在英語中,自營網站的占比達到 80.2%。

這顯示在比較類媒體不充分的類別中,提供者自己發布的資訊更容易被 AI 引用;同時也確認了,沒有英文頁面的提供者很難進入候選名單——以多語言發布官方資訊本身,就與能見度直接相關。

4. 商家出現率(品牌單位・僅頭部)

本章整理回答中實際被提及名稱的商家,及其出現傾向。

第 0 號能評估的僅限於頭部群體的集中度。因為沒有前期可比較,本期不涉及月度變化(差異見第 5 章)。另外,第 3 章分析的引用來源分布,與本章的商家出現率是不同的指標——第 3 章看的是「哪個資訊來源被引用」,本章看的是「哪個商家在回答中被點名」。

和服:確認四種語言的回答後,發現有一個頭部群體(約 8 家商家)幾乎每次都會被提及,這個頭部群體在日語、英語、簡體中文、繁體中文之間高度重疊。而引用來源的組成會因語言而異——日語以比較類媒體為主,英語以 OTA 與旅遊媒體為主,中文以官網為主(見§3.1)。也就是說,隨語言變化的是「經由哪個資訊來源」,最終被介紹的商家本身變化不大。

坐禪:比較四種語言的回答,有一家商家(內部管理 ID)在日語、簡體中文、繁體中文中出現最多,英語中也名列前茅。這從商家層面印證了§3.5的結論:在比較類媒體較少的類別中,提供者自身發布的資訊更容易被引用。

茶道:茶道也有一個約 5 家商家組成的頭部群體,在四種語言中大致一致,關鍵字型與自然語言型之間也未觀察到明顯差異。與和服相同,引用來源的種類會隨語言變化,而 AI 實際介紹的商家在四種語言間展現出高度的一致性。

四種語言的共通特徵:和服與茶道雖然引用來源的種類因語言差異很大,但 AI 實際點名的商家在四種語言間相當一致。這暗示隨語言變化的是「參考哪個資訊來源」,而非「最終介紹哪個商家」。

第 0 號將這個重疊現象作為基準記錄下來,之後每月會如何變化,將自第 1 號起持續追蹤。

5. 與前期的差異

第 0 號是本系列報告的基準線,因此沒有可比較的前期。我們將本期展示的結果作為基準(t=0),自第 1 號(2026年9月)起,持續記錄相對於此基準的變化。

6. 與雜訊底的對照

同一查詢連續重複 20 次時,引用來源集合的重疊度(Jaccard 係數)如下。

簡中繁中
茶道0.250.200.310.25
和服0.410.160.150.11
坐禪0.350.400.220.23

即使是同一個問題,每次執行都會有半數以上的引用來源發生變化。

日語、英語的茶道(0.247・0.204)與外部研究(Green et al.)報告的數值(0.265)相當接近,這說明我們獨立觀測到的波動,與外部研究是一致的。

本報告將這種波動定位為「雜訊底」。評估月度變化時,只有超過此基準的變動才會被視為有意義的訊號(詳見附錄A)。

因此,僅憑一次回答(n=1)無法斷言「AI 就是這麼說的」。引用來源的組成比在 20 次觀測後大致收斂到 ±10 個百分點左右,而個別商家的出現率波動更大,因此第 0 號僅評估頭部群體。

7. 附錄

下期預告(2026年9月):第1號將報告以第0號為基準的首次差異,重點追蹤和服類別比較類媒體份額的變化,以及§3.4中未解釋觀測的後續驗證。


本文為個人調查與資訊分享專案,與特定團體、大學、企業等無關。資料以 CC BY 4.0 無償公開,不販售。