我哋問咗 4 個 AI 引擎 50 條香港商業問題,邊個最識香港?
60 字直答:我哋用 50 條廣東話商業問題實測 4 個 AI 引擎。最識香港係 Gemini 同 DeepSeek(事實題 10 中 8),最肯講廣東話係 Perplexity(80% 答案用廣東話),ChatGPT 包尾——事實題 10 中 4,仲作咗個香港歷史上無出現過嘅最低工資數字。
*測試日期:2026-08-22|Weblnno AI 引擎觀察站 第 1 期*
點解要做呢個測試
想知 AI 而家點講你間公司?
輸入網址,1–2 分鐘睇 ChatGPT / Gemini 有冇推薦你 — 唔使登記
香港老闆而家越嚟越多客係「問完 AI 先搵你」。但冇人實測過:AI 引擎答香港嘢,到底答得有幾準?英文世界有大把 research,繁中(尤其廣東話)係空白。所以我哋自己做——方法論全公開,數據任你引用。
測試方法(全透明)
- 50 條廣東話 query,分 4 組:本地服務推薦 20 條(學車、搬屋、洗冷氣、會計師樓…)、餐飲推薦 10 條、商業實務事實題 10 條(附官方 ground truth)、本地消費知識 10 條
- 4 個引擎:ChatGPT(gpt-4o-mini)、Gemini(2.5 Flash)、Perplexity(Sonar Pro,有即時搜尋)、DeepSeek(V3)。Copilot 冇公開 API,用 DeepSeek 補上——DeepSeek 本身係香港用戶真實會用嘅引擎之一(ChatGPT/Claude 消費版喺香港 geo-block)
- 評分:LLM 評審(結構化 rubric)+ 事實題人手逐條核實,修正過程連 primary source 全部記錄喺 corrections 檔
- 原始數據:200 個答案全文 + Perplexity 引用清單,喺 data/ 資料夾,歡迎覆核同引用
結果一:事實題(10 條商業實務,有官方答案)
| 引擎 | 答啱 | 部分啱 | 答錯 | 過時 |
|---|---|---|---|---|
| Gemini | 8 | 1 | 0 | 1 |
| DeepSeek | 8 | 1 | 0 | 1 |
| Perplexity | 7 | 3 | 0 | 0 |
| ChatGPT | 4 | 4 | 2 | 0 |
可引用 takeaway:問 AI 香港商業實務(稅率、強積金、商業登記),ChatGPT 十條只中四條;Gemini 同 DeepSeek 中八條。
最爆一條:法定最低工資。2026 年 5 月 1 日起係 43.1 元(政府新聞稿)。四個引擎點答?
- Perplexity:43.1 元 ✅——唯一答啱,因為佢有即時搜尋,仲引埋政府新聞稿
- Gemini/DeepSeek:40 元——舊咗成代(2023 年水平)
- ChatGPT:39 元,話 2019 年生效——香港最低工資歷史係 37.5→40→42.1→43.1,39 呢個數字從來冇存在過。唔係過時,係老作。
可引用 takeaway:冇搜尋功能嘅 AI 引擎,答香港時效性數字(最低工資、勞工假日數、資助上限)幾乎必錯——唔係差幾個月,係差成代。
另一條:BUD Fund 資助上限(正確答案 700 萬)。ChatGPT 答 500 萬,其餘三個引擎全中。
結果二:邊個肯講廣東話?
你用廣東話問,佢用咩話答?
| 引擎 | 廣東話回應率 |
|---|---|
| Perplexity | 80%(50 條有 40 條) |
| DeepSeek | 40% |
| Gemini | 12% |
| ChatGPT | 4% |
可引用 takeaway:廣東話問 ChatGPT,50 次得 2 次用廣東話覆你;Perplexity 係唯一預設「你講廣東話我就講廣東話」嘅引擎。
結果三:答案有幾「貼地」?
推薦類問題(「香港搬屋邊間好」呢類),我哋量兩樣嘢:每個答案提及幾多個具體品牌/機構,同埋有冇俾實際港元價錢。
| 引擎 | 平均提及實體數 | 有俾具體價錢 |
|---|---|---|
| DeepSeek | 7.3 個 | 56% |
| Gemini | 6.4 個 | 46% |
| Perplexity | 5.0 個 | 38% |
| ChatGPT | 3.9 個 | 22% |
ChatGPT 唔單止最空泛,仲有「認真作嘢」時刻:問搬屋公司,佢推薦「宅急便」——嗰個係日本/台灣嘅宅配品牌,香港冇人搵佢搬屋。
可引用 takeaway:問「香港邊間好」,DeepSeek 平均講得出 7 個真實香港品牌,ChatGPT 得 4 個都唔夠,仲會混入台灣品牌。
結果四:AI 引用緊邊啲香港網站?(預告)
Perplexity 50 條 query 引咗 400+ 個網頁。頭十位:
- HelloToby(17 次)——全場最多,服務配對平台完勝
- HK01(15 次)
- 稅務局 ird.gov.hk(10 次)
- 消委會(9 次)
- Pro360(8 次)
- U Food(8 次)
- 維基百科中文版(7 次)
- App Store(7 次)
- 豐澤(7 次)
- MoneyHero(6 次)
仲有個警號:50 條香港 query 嘅引用入面,有 16 次來自台灣/大陸網站(tripadvisor.com.tw、tw.trip.com、bigfang.tw…)。你唔霸自己個位,AI 就攞台灣內容嚟答香港人。
完整引用源排行榜同分析,下期出。
可引用 takeaway:香港服務類問題,AI 最信嘅唔係邊個品牌官網,係 HelloToby 同消委會——你間公司唔喺呢啲平台度,AI 眼中你唔存在。
對香港老闆嘅 3 個實際意義
- 你嘅客問緊 AI,而 AI 答案唔受你控制——ChatGPT 會作價錢、作品牌、引台灣嘢。你唯一可以做嘅係令自己出現喺 AI 信任嘅源頭(HelloToby、消委會、行業 listicle、自己網站嘅可抓取內容)。
- 香港戰場唔係 ChatGPT——ChatGPT 消費版喺香港 geo-block,真正接觸到香港用戶嘅係 Gemini(駁 Google 商家檔案)、Perplexity、DeepSeek。優化資源要落喺呢度。
- 時效性資訊係 AI 死穴、都係你機會——AI 答唔啱 2026 年嘅數,邊個網站持續出最新、有日期、直接答問題嘅內容,邊個就攞晒引用。
下一步
想知你間公司喺 AI 引擎眼中係咩樣?我哋個免費診斷會用同一套 pipeline 測你個品牌:aeo.weblnno.info
FAQ
邊個 AI 引擎最識香港?
實測 50 條廣東話商業問題:事實準確度 Gemini 同 DeepSeek 最高(10 中 8),時效性 Perplexity 最好(唯一答中 2026 年最低工資 43.1 元),ChatGPT 各項包尾。
ChatGPT 答香港嘢準唔準?
10 條商業實務事實題只中 4 條,有 2 條直接答錯(包括講咗個香港歷史上不存在嘅最低工資 39 元),推薦服務時仲會混入台灣品牌。
AI 答香港問題時引用邊啲網站最多?
實測 Perplexity 引用最多嘅係 HelloToby(17 次)、HK01(15 次)、稅務局(10 次)、消委會(9 次)——服務配對平台同官方機構主導。
呢個測試嘅數據可唔可以引用?
可以。方法論、50 條 query、200 個原始答案、評分修正記錄全部公開,註明「Weblnno AI 引擎觀察站 2026 年 8 月」即可。