
國外 AI 搜尋監測公司 Otterly.AI 這一年發表了一系列引用研究:分析 Claude 的 37.9 萬筆引用、跨引擎的百萬筆引用報告,甚至做了德文在地版。繁中一直沒有人做——所以我們自己動手:60 個台灣人真實會問的問題、三個 AI 搜尋引擎,15,729 筆引用逐筆分類。
為了讓結果站得住,我們在收任何資料之前,就先把研究設計固定下來:要問哪 60 題、每題問幾次、引用怎麼分類計分,以及對結果的五項預測,全部先寫死。這樣做是為了避免「跑完再挑好看的數字講」——設計先凍結,結論才不會是事後湊出來的。方法與五項預測的摘要放在文末。
為什麼是這三個引擎?依台灣實際使用狀況選的:台灣生成式 AI 滲透率已達 43%(TWNIC 2025 台灣網路報告,三個月內使用率、年增 16 個百分點);Similarweb 2026 年 6 月台灣全類別流量榜上,gemini.google.com 排第 8、chatgpt.com 排第 10——AI 工具已經擠進台灣人最常造訪網站的前十名;Otterly.AI 的 APAC 研究亦將 ChatGPT 列為台灣第一、Google 系第二。Perplexity 未進台灣流量前 50,但它是 AI 搜尋的代表性產品、也是引用行為研究的常見基準,我們把它當對照引擎。
這是台灣繁中 AI 引用生態系列的總報告,其他各篇深挖單一主題,每篇都可獨立閱讀。
一分鐘看完重點
- 60 題台灣消費者真實問法 × 三個引擎(ChatGPT/GPT-5、Gemini 2.5 Flash、Perplexity Sonar)=15,729 筆引用(Perplexity 5,510+Gemini 8,394+ChatGPT 1,825),逐筆標來源類別與語言。
- 三個引擎的引用網域幾乎不重疊:Perplexity 對 Gemini 只有 20.1% 重疊,ChatGPT 對另外兩個更只有 5~6%(Jaccard,註冊網域層),三個引擎共同的網域只有 39 個。Otterly.AI 英文實測 ChatGPT vs Claude 是 13%,繁中比英文更極端——每個 AI 都是一個獨立的曝光戰場。
- 三個引擎三種個性:Perplexity 是社群派(論壇 10.8%+社交 7.9%+影音 6.7%,愛引 Threads、Dcard、YouTube);Gemini 是官網派(官網 35.5%+新聞 12.0%);ChatGPT 是官方權威派(官網 55.8%+政府與研究機構 21.2%,愛引美國 NIH、EPA、日本觀光官網)。
- ChatGPT 還多一道前置門檻:只有 46% 的題目會觸發搜尋,其餘直接用模型記憶回答、完全不附來源。
- Wikipedia 在三引擎合計 15,729 筆引用中占比不到 0.2%(英文研究是 2.1%)——繁中維基幾乎不被 AI 當來源。
我們怎麼測
題目來自真實搜尋
60 題全部取材自 Google 自動完成、「其他人也問」,以及 Dcard、PTT、Mobile01 上的真實提問語氣,涵蓋生活家電、保健食品、軟體工具、旅遊、金融五個「買之前會認真查」的品類,每個品類再依購買意圖分四層——從最廣泛的「益生菌推薦」,到最具體的品牌比較「國泰 cube 卡好用嗎」。
每題問很多次,抵銷 AI 的隨機性。
測的時候,每一題就是使用者會打的那句話,一字不加、不給額外指令、不帶對話紀錄地送進引擎。因為 AI 的回答有隨機性(同一題問兩次,來源清單常常不一樣),所以每題重複問多次來抵銷抖動:Perplexity 和 Gemini 各問 10 次、ChatGPT 問 5 次。三個引擎分開跑、分開報告,各自在一個短時間窗內跑完,避免中途模型改版。收回來的每一筆引用,我們抽出網域、標上 12 類來源類型與語言,並人工抽查 10% 覆核分類品質。這份研究只測「消費決策型」的繁中查詢,用的是各引擎的 API(消費者實際用的介面行為可能略有不同),也只是單一時間窗的快照——這些限制我們寫在文末,數字請搭配著看。
這不是「問 AI 的記憶」,而是看 AI 現在搜尋會引誰
這是最容易被誤會的一點:我們測的三個引擎全部開啟即時網路搜尋(Perplexity 本身就是搜尋引擎、Gemini 掛 Google Search grounding、GPT-5 掛 web_search 工具),每一筆引用都是引擎當下搜尋、檢索後附上的真實來源連結,不是模型訓練時背下來的東西。
但 ChatGPT 會自己決定要不要搜——這本身就是發現。
Perplexity 每題必搜、Gemini 幾乎每題都搜,ChatGPT 卻只有 46% 的題目觸發了搜尋(分意圖層看:廣泛題 L1 44%、情境題 L2 44%、條件題 L3 36%、品牌比較題 L4 高達 70%),其餘的題它直接用模型記憶回答、不附任何來源。也就是說,在 ChatGPT 上,超過半數的消費決策問題,答案完全由訓練記憶決定,你再怎麼優化內容都碰不到它。
發現一:同樣的問題,三個引擎給三種來源世界
| 類別 | Perplexity | Gemini | ChatGPT |
|---|---|---|---|
| 評測導購站 | 21.4% | 20.5% | 6.1% |
| 品牌官網 | 18.6% | 35.5% | 55.8% |
| 部落格/個人網站 | 18.0% | 20.4% | 0.4% |
| 論壇社群 | 10.8% | 3.2% | 7.4% |
| 新聞媒體 | 8.8% | 12.0% | 1.4% |
| 社交媒體 | 7.9% | 0.1% | 0.1% |
| 電商平台 | 7.1% | 5.0% | 6.8% |
| 影音 | 6.7% | 1.4% | 0.0% |
| 政府/研究機構 | 0.7% | 1.3% | 21.2% |
| 百科 | 0.0% | 0.1% | 0.2% |
三個引擎只有兩件事有共識:繁中維基幾乎不被引用,以及電商平台(momo、PChome)都占一小塊。除此之外,它們各走各的路:
- Perplexity 重社群與影音:論壇、社交、YouTube 加起來超過四分之一,它把 Threads、Dcard 上的真實討論當答案原料。
- Gemini 偏官網與新聞:幾乎無視社交媒體(0.1%),偏好結構完整的官網頁面和媒體報導。
- ChatGPT 極端權威導向:品牌官網加政府/研究機構合計 77%,部落格(0.4%)和新聞(1.4%)近乎歸零——它引的是 NIH、EPA、日本觀光廳這種「機構級」來源。
發現二:三個引擎的引用網域幾乎不重疊
如果同一批問題三個引擎引的是同一批網站,那「AI 優化」就有一套通解。但實情相反:
- Perplexity 引用集中在 373 個網域,前 10 名就吃掉 29.1%——生態集中。
- Gemini 攤在 1,301 個網域上,前 10 名只占 14.8%,近四成網域只被引用一次——生態分散、長尾機會多。
- ChatGPT 用 496 個網域,高度集中在美日官方與品牌官網。它和 Perplexity 的網域重疊只有 5.4%、和 Gemini 6.3%(Perplexity 對 Gemini 之間也才 20.1%)。
三個引擎共同引用的網域,只有 39 個。 我們事前的預測 P4(任兩引擎的網域重疊低於 30%)——三組全部成立。對品牌的意思很直接:在 Perplexity 上被看見,不代表在 ChatGPT 上也被看見,這是三個要分開經營的戰場。
發現三:從九成繁中到七成外文的語言光譜
| 語言 | Perplexity | Gemini | ChatGPT |
|---|---|---|---|
| 繁中(台灣) | 87.8% | 71.4% | 30.1% |
| 英文 | 5.5% | 18.1% | 44.4% |
| 日文 | 1.5% | 4.3% | 23.1% |
| 繁中(港澳) | 2.9% | 4.3% | 0.1% |
| 簡中 | 2.2% | 1.7% | 2.2% |
同樣是繁中問題,三個引擎引用的內容語言天差地遠。非繁中引用合計:Perplexity 只有 9.2%(推翻我們「非繁中會 ≥20%」的預測)、Gemini 24.0%(成立)、ChatGPT 高達 69.7%(強烈成立)——台灣使用率最高的 AI,引用的繁中內容反而最少。
同一條事前寫死的預測,三個引擎給出從「推翻」到「爆表」的完整光譜。這正是為什麼引用研究一定要分引擎報告——混在一起平均,等於把三個相反的事實抹成一個沒意義的中間值。為什麼差這麼多、對你的內容策略是什麼意思,我們在系列的語言篇深入拆解。
發現四:我們賭對了幾條?
開跑前寫死的五條預測,攤開對答案:
| 預測 | Perplexity | Gemini | ChatGPT |
|---|---|---|---|
| P1 論壇 >5% | 10.8% ✅ | 3.2% ❌ | 7.4% ➖(信賴區間跨門檻) |
| P2 非繁中 ≥20% | 9.2% ❌ | 24.0% ✅ | 69.7% ✅ |
| P3 電商 ≥10% | 7.1% ❌ | 5.0% ❌ | 6.8% ❌ |
| P4 網域重疊 <30% | ✅ 三組全成立(P-G 20.1%、P-C 5.4%、G-C 6.3%) | ||
| P5 官網 <40% | 18.6% ✅ | 35.5% ✅ | 55.8% ❌ |
五條裡,除了 P4,沒有任何一條在三個引擎上判定一致。我們照登所有結果,包括賭錯的 P3(以為電商會破一成,其實沒有)和被 ChatGPT 推翻的 P5(它的官網占比 55.8%,是唯一「官網才是主角」的引擎)。這種「事前公開下注、事後照實對答案」的做法,正是這份研究和「隨手截一張 AI 回答的圖」最大的差別。
和國際研究比:我們印證了什麼、又發現了什麼不一樣
這份研究的起點,是 Otterly.AI 在英文市場做的一系列引用研究。很多人會想把兩邊的數字直接並排——但這其實不能比:他們用英文問、我們用繁中問,光是「查詢語言」就決定了會撈到什麼語言的內容,再加上引擎不同、市場不同,把類別占比擺在一起看,只會混淆而不會有洞察。所以我們不比數字,比「結論的形狀」:
印證的部分——這些不是英文獨有的現象:
- Otterly.AI 發現不同引擎之間引用網域重疊極低(ChatGPT vs Claude 僅 13%);我們在繁中量到 5~20%,同樣成立、甚至更極端。「AI 引用高度分引擎」是跨語言的通則。
- Otterly.AI 指出多數引用來自第三方、品牌官網不是主角;我們在 Perplexity 與 Gemini 上看到同樣的結構(第三方占八成、六成半)。
不一樣的部分——這些是繁中/台灣的在地發現:
- ChatGPT 在繁中反轉了「官網不是主角」:它的官網占比 55.8%,是三個引擎裡唯一「官網當家」的,這在英文研究的普遍結論之外。
- 語言缺口是英文研究測不到的維度:繁中查詢卻有高達七成(ChatGPT)引用外文內容,這只有做在地版才看得見。
- 電商平台夾層(momo、PChome)和繁中維基的缺席,都是台灣生態的特徵。
唯一能乾淨對照的一組同引擎數字:Otterly.AI 測得 Perplexity 英文論壇引用 16.9%,我們測台灣 Perplexity 是 10.8%——同一個引擎、只換市場,台灣的論壇引用比英文低一截。
這對品牌與行銷人的意義
- 沒有「AI 優化」這種單一動作。 Perplexity 的曝光靠論壇、社群、影音;Gemini 靠官網內容與權威站;ChatGPT 靠官方與研究機構背書。預算要按你的受眾用哪個 AI 來分配,不能一招打天下。
- Perplexity 和 Gemini 通吃的公約數,是第三方內容層。 導購站的評比收錄、部落客的真實開箱,在這兩個引擎都是前二大來源。但 ChatGPT 幾乎只認官方——想被它引用,靠的是權威背書和官網內容,不是社群聲量。
- Gemini 的長尾是中小品牌的機會。 1,301 個網域、頭部集中度低,小站擠進引用榜的門檻比 Perplexity 低得多。
- ChatGPT 要先過「搜尋觸發」這一關。 有 54% 的題目它根本不搜尋、答案由訓練記憶決定——而品牌比較題的觸發率高達 70%,這是內容真正能影響它的主戰場。
研究方法與事前預測(摘要)
研究設計:
- 題目:60 題繁中查詢,生活家電/保健食品/軟體工具/旅遊/金融各 12 題,每品類再依購買意圖分四層;取自 Google 自動完成、「其他人也問」與 Dcard/PTT/Mobile01 真實提問語氣。
- 引擎:Perplexity Sonar、Gemini 2.5 Flash(Google Search grounding)、ChatGPT(GPT-5+web_search),全部開啟即時搜尋。
- 重複次數:Perplexity/Gemini 每題 10 次、ChatGPT 每題 5 次,均為無狀態呼叫(不帶對話紀錄)。
- 執行:2026 年 7 月,各引擎在單一時間窗內跑完,避免中途模型改版。
- 分類:每筆引用抽出網域,標 12 類來源類型與語言,人工抽查 10% 覆核。
五項事前預測:
- P1:論壇社群引用 >5%——英文研究裡論壇占比低(Claude 僅 1.3%),但台灣有 PTT/Dcard/Mobile01 的強論壇文化,我們預期會明顯高於英文基準。
- P2:非繁中來源引用 ≥20%——繁中只占 ChatGPT 訓練語料約 0.05%(簡中 16.2%),推測檢索端也會大量漏到外文內容。
- P3:電商平台引用 ≥10%——台灣電商(momo、PChome、蝦皮)滲透率高,先前實驗常觀察到它們被引用。
- P4:任兩引擎的引用網域重疊 <30%——Otterly.AI 英文實測 ChatGPT vs Claude 只有 13% 重疊,推測繁中也會各自為政。
- P5:品牌官網引用 <40%——英文研究官網占 64%,但台灣第三方內容(導購站、部落格、論壇)密度高,預期官網占比會遠低於此。
限制:用各引擎 API,消費者實際使用的 App/網頁介面行為可能略有不同;60 題為研究者選定的高考慮消費決策品類,不外推到其他查詢類型;單一時間窗快照,不含跨時間穩定性;跨引擎合併網域時已統一正規化到「註冊網域」層級。本研究方法會隨後續實驗迭代。
繁中 AI 引用生態系列:
– 【總報告】ChatGPT、Gemini、Perplexity 活在三個世界(本篇)
– 【榜單篇】台灣最常被 AI 引用的網站排行
– 【語言篇】ChatGPT 七成引外文、Perplexity 九成引繁中
– 【官網篇】你的官網不是主角,八成引用指向第三方
—— Vanessa | GEO is cool