普通話與粵語:每位翻譯人員都該知道的關鍵差異

OpenL Team 4/10/2026
普通話與粵語:每位翻譯人員都該知道的關鍵差異

TABLE OF CONTENTS

普通話與粵語常被籠統地歸為同一種「中文」,但兩者的互通程度其實大約就像葡萄牙語與義大利語——同源、共用一套書寫系統,聽起來卻截然不同。

前言

若問一位不熟悉東亞的人「中文」到底有幾種語言,你大概會聽到「一種」。實際上,中國境內存在著一個彼此相關卻各自獨立的語言家族,其中最知名的兩種是普通話(Pǔtōnghuà)與粵語(Gwóngdūngwá)。

普通話約有9.33億母語使用者,是中國、台灣與新加坡的官方語言。粵語約有8,500萬母語使用者——比德國全國人口還多——在香港、澳門、廣東省以及全球各地海外華人社區中佔主導地位。

對鎖定中文受眾的翻譯人員與企業而言,理解這些差異至關重要。普通話翻譯在香港會完全失準。人工智慧翻譯工具處理這兩種語言的方式也大不相同。本指南涵蓋所有主要差異:聲調、書寫系統、語法、地區使用情況,以及人工智慧翻譯的挑戰。

快速決策框架

在深入語言細節之前,這裡提供一套實用的框架,幫助你決定需要哪一種中文:

如果你符合以下情況,請選擇普通話:

  • 目標受眾位於中國大陸、台灣或新加坡
  • 與中國政府機關或國有企業往來
  • 為盡可能最大的中文受眾製作教育內容
  • 為一般中文市場開發應用程式或網站

如果你符合以下情況,請選擇粵語:

  • 目標受眾位於香港或澳門
  • 為北美、英國或澳洲的海外華人社區進行內容本地化
  • 與粵語媒體合作(香港電影、粵語流行曲)
  • 翻譯根植於中國南方的歷史或文化文本

如果你符合以下情況,可能會兩者都需要:

  • 執行泛中文行銷活動
  • 為大中華地區的使用者建立客戶支援系統
  • 為同時在中國大陸與香港發行的媒體製作字幕

聲調與發音

普通話與粵語的聲調系統,或許是兩者之間最立即顯著的差異。兩者都是有聲調的語言——意思是發音時使用的音高模式會完全改變音節的意義——但兩者在複雜度上差異極大。

普通話的四個聲調

普通話有四個主要聲調,外加一個輕聲(不重讀)聲調:

聲調名稱音高模式範例意義
第一聲高平高而平mā (媽)母親
第二聲上升中到高má (麻)大麻
第三聲下降後上升中低,然後上升mǎ (馬)
第四聲下降高到低mà (罵)責罵
輕聲短、不重讀ma (嗎)疑問語氣詞

這四個聲調的輪廓相對分明——一條平線、一條上升線、一個下凹,以及一段急降——對初學者來說相對容易分辨。

粵語的六個聲調

粵語在現代標準用法中有六個聲調(傳統分析最多計為九個,但三個「入聲」與第1、3、6聲共用音高模式,差別只在於以塞音收尾):

聲調音高模式粵拼編號範例意義
高平高而平1sī (詩)
中升中到高2sí (史)歷史
中平中而平3si (試)嘗試
低降低,略微下降4sìh (時)時間
低升低到中5síh (市)市場
低平低而平6sih (是)是(to be)

粵語聲調的挑戰在於,其中三個(第1、3、6聲)都是平調——既不上升也不下降——差別僅在於音高高低。對非母語者而言,要分辨「高平」與「中平」,需要比分辨普通話的上升聲與下降聲更多的聽力訓練。

子音與母音差異

除了聲調之外,兩種語言的語音系統也有相當大的差異:

  • 普通話有粵語所沒有的翹舌音(zh、ch、sh、r)
  • 粵語有普通話所沒有的聲母,例如 ng-、kw- 和 gw-
  • 粵語保留了中古漢語的韻尾塞音(-p、-t、-k),而普通話已完全丟失
  • 粵語有更豐富的母音系統,包含更多雙母音和三母音
  • 普通話的音節結構較簡單,通常由聲母、母音和可選的鼻音韻尾(-n 或 -ng)組成

這些差異意味著粵語約有1,760個不同音節,而普通話約有1,300個——這也是粵語與古典漢詩保留更多語音連結的原因之一。

羅馬拼音系統

  • 普通話使用漢語拼音(拼音),於1950年代制定:Běijīng (北京)
  • 粵語使用粵拼(Jyutping),由香港語言學學會制定:Bak1ging1 (北京)

書寫系統:簡體與繁體

對翻譯人員來說,最實際的差異之一就是書寫系統。雖然普通話與粵語共用同一套底層漢字,但兩者通常使用不同的標準字形。

繁體字

繁體字是歷史更悠久、結構更複雜的字形,已使用數千年。它們從古代的甲骨文,歷經篆書與隸書演變,約在西元5世紀達到現代形態。

使用地區: 香港、澳門、台灣,以及大多數海外華人社區

範例: 「龍」字的繁體形是 龍(16畫)。

簡體字

1949年中華人民共和國成立時,識字率約為20%。1950至60年代,政府簡化了約2,000個漢字,讓閱讀與書寫更容易。

使用地區: 中國大陸、新加坡、馬來西亞

範例: 同一個「龍」字的簡體形是 龙(5畫)。

翻譯人員需知的關鍵差異

面向簡體繁體
筆畫數較少(通常減少30-60%)較多(原始的複雜度)
漢字合併一個字可能對應多個繁體字一對一的意義
主要地區中國大陸、新加坡、馬來西亞香港、澳門、台灣
數位輸入標準輸入法同時支援兩種系統兩種系統皆支援
詞彙部分用詞不同(例如以 软件 表示「軟體」)部分用詞不同(例如香港用 軟件,台灣用 軟體)

一個重要的細節:簡體/繁體的區分並不完全等同於普通話/粵語。台灣使用繁體字書寫普通話;新加坡使用簡體字。然而實際上,粵語內容幾乎總是使用繁體字(因為它主要在香港與澳門以書面形式呈現)。

粵語專用字

粵語有一些標準書面中文(以普通話語法為基礎)中沒有的字。這些字在香港的非正式書寫、簡訊和社群媒體中廣泛使用:

  • 嘅 (ge3) — 所有格助詞(相當於普通話的 的)
  • 係 (hai6) — 「是」(相當於普通話的 是)
  • 唔 (m4) — 否定(相當於普通話的 不)
  • 佢 (keoi5) — 「他/她/它」(相當於普通話的 他/她/它)
  • 嗰 (go2) — 「那」(相當於普通話的 那)
  • 冇 (mou5) — 「沒有」(相當於普通話的 沒有)

這些字對未針對粵語專用 Unicode 範圍最佳化的翻譯工具構成挑戰。

語法比較

普通話與粵語共用相同的基本句型——主詞-動詞-受詞(SVO)——而且兩種語言都沒有語法性別、名詞格變化或動詞變化。然而,兩者之間仍存在若干重要的語法差異。

語序差異

雖然兩者都遵循 SVO 語序,但某些結構的運作方式有明顯變化:

間接受詞:

  • 普通話:我給你一本書 (Wǒ gěi nǐ yī běn shū) — 「我給你一本書」(動詞 + 間接受詞 + 直接受詞)
  • 粵語:我畀一本書你 (ngo5 bei2 jat1 bun2 syu1 nei5) — 「我給你一本書」(動詞 + 直接受詞 + 間接受詞)

比較結構:

  • 普通話:他比我高 (Tā bǐ wǒ gāo) — 「他比我高」(比較對象 + 形容詞)
  • 粵語:佢高過我 (keoi5 gou1 gwo3 ngo5) — 「他比我高」(形容詞 + 超過標記)

句尾語氣詞

這正是粵語與普通話真正分道揚鑣之處。兩種語言都使用句尾語氣詞——加在句子末尾、用來表達語氣、態度或語法功能的小音節——但粵語的系統遠為複雜精細。

普通話約有7到17個常用句尾語氣詞,包括:

  • 嗎 (ma) — 是非問句標記
  • 呢 (ne) — 追問或延續
  • 吧 (ba) — 建議或推測
  • 了 (le) — 狀態改變或動作完成
  • 啊 (a) — 緩和語氣或感嘆

粵語至少有30個基本句尾語氣詞,研究者記錄到的變體形式超過200種。一些常用例子包括:

  • 呀 (aa3) — 緩和語氣,讓陳述聽起來自然
  • 㗎 (gaa3) — 強調,「你知道的」
  • 喎 (wo3) — 驚訝或新資訊
  • 囉 (lo1) — 「當然」,「本來就是這樣」
  • 啦 (laa1) — 催促或建議
  • 嘅 (ge3) — 斷言或確認
  • 咩 (me1) — 驚訝的疑問,「真的嗎?」

粵語語氣詞特別複雜的地方在於它們可以堆疊——兩三個語氣詞串在一起,每個都增添一層細微差異。它們也能透過延長音長和改變音高來進一步修飾意義。這套語氣詞系統對粵語如此重要,以至於香港使用者經常在日常英語句子中夾入粵語語氣詞。

體貌標記

兩種語言都會標記動詞的體貌(動作是完成、進行中,還是曾經歷過),但使用的標記不同:

體貌普通話粵語
完成動作了 (le)咗 (zo2)
進行中的動作在 (zài) / 正在 (zhèngzài)緊 (gan2)
過去經驗過 (guò)過 (gwo3)
持續著 (zhe)住 (zyu6)

詞彙差異

即使表達同一個概念,普通話與粵語也常使用完全不同的詞:

英文普通話粵語
吃 (chī)食 (sik6)
看 (kàn)睇 (tai2)
說 (shuō)講 (gong2)
想 (xiǎng)諗 (nam2)
東西東西 (dōngxi)嘢 (je5)
什麼什麼 (shénme)乜嘢 (mat1 je5)
很 (hěn)好 (hou2)
不 (bù)唔 (m4)
跑 (pǎo)走 (zau2)
漂亮漂亮 (piàoliang)靚 (leng3)

這些不只是口音或方言的差異——它們是詞源不同的根本相異詞彙,可類比為西班牙語的 “hablar” 與葡萄牙語的 “falar” 之間的差別。

地區使用情況與地位

普通話的主導地位

普通話是中華人民共和國唯一的官方語言,正式名稱為 Pǔtōnghuà(普通話,意為「共通語」)。中國政府推行強勢的推廣政策:到2020年,約80%的中國人口能說普通話,目標是2025年達到85%。普通話同時也是:

  • 台灣的官方語言(稱作 Guóyǔ 國語)
  • 新加坡四種官方語言之一
  • 聯合國六種官方語言之一
  • 全球最多人學習的中文變體,擁有數百萬名外國學習者

粵語的根據地

儘管使用人數少得多,粵語在若干地區依然極其重要:

  • 香港:750萬人口中有88.2%以粵語為主要語言(2021年人口普查)
  • 澳門:粵語是使用最廣泛的語言,約80%人口使用
  • 廣東省:粵語的歷史核心地帶,人口超過1.2億——儘管普通話在年輕世代中日益佔主導地位
  • 廣西省:南部地區使用粵語,尤其是梧州與南寧一帶

全球離散社群

由於早期中國移民潮(19世紀至20世紀初)大多來自廣東,粵語成為海外華人社區中的主導中文語言:

  • 加拿大:565,275名居民通報粵語為母語(2016年人口普查)
  • 美國:在三藩市、紐約與洛杉磯有大型社區
  • 英國:倫敦與曼徹斯特有大型社區
  • 澳洲:雪梨與墨爾本有相當規模的社區
  • 東南亞:馬來西亞、越南、柬埔寨與泰國的華人社區使用粵語

承受壓力的語言

粵語在其傳統根據地面臨日益增長的壓力。在廣東,大規模移民與普通話推廣已減少年輕居民的使用。在香港,自1997年回歸以來對普通話日益重視,引發了對粵語未來的擔憂。

然而,粵語仍與香港的文化認同、粵語流行曲,以及全球產量最豐富的電影產業之一緊密相連——確保了對粵語翻譯與本地化的持續需求。

人工智慧翻譯的挑戰

對任何使用人工智慧翻譯工具的人來說,普通話與粵語之間的分野帶來了一些獨特且往往令人挫折的挑戰。

普通話:資源充足,但並非完美

普通話是人工智慧翻譯中支援最完善的語言之一。Google Translate、DeepL 以及大多數主要翻譯平台都提供穩健的普通話支援。然而,挑戰依然存在:

  • 簡體與繁體的轉換並非單純的字形替換——中國大陸、台灣與新加坡之間的詞彙、措辭與文化引用各不相同
  • 文言文典故與現代文本中的文學隱喻可能讓人工智慧模型出錯
  • 依賴語境的字:字「了」可以作為動作完成標記、狀態改變語氣詞,或複合詞的一部分——人工智慧系統有時會誤判它扮演的角色
  • 語域與正式程度:中文的正式書面語與口語之間差異顯著,人工智慧工具可能無法一致地處理

粵語:低資源語言

儘管有8,500萬使用者——比義大利語、韓語或荷蘭語還多——粵語在人工智慧翻譯領域仍被歸類為「低資源語言」。這造成了重大問題:

工具支援有限:截至2025年,Google Translate 並未將粵語列為獨立的語言選項。大多數主要翻譯平台都把「中文」等同於普通話,讓粵語使用者得不到充分服務。

訓練資料稀缺:NAACL 2025 的研究顯示,大型語言模型在粵語任務上的表現明顯不如普通話。可取得的訓練資料有限、嘈雜,且偏向正式文本。

書面粵語的複雜性:以普通話訓練的人工智慧模型,常因粵語獨特的字與語法而產生不自然的輸出。

語言混淆:模型有時會把粵語與普通話或日語搞混。研究者曾記錄粵語文本被錯誤翻譯成日語片假名的案例。

語碼混用:來自香港的真實粵語文本經常混合粵語、英語與普通話——對使用者來說很自然,對人工智慧卻極具挑戰。

這對翻譯人員意味著什麼

如果你在處理粵語內容,單靠人工智慧翻譯是有風險的。最佳實務包括:

  1. 務必指定目標變體:不要假設「中文」就是你要的。明確指定你需要普通話(簡體或繁體)還是粵語
  2. 使用專門工具:像 OpenL 這類支援多種中文變體的工具,能比一般用途的翻譯器產出更準確的結果
  3. 人工審閱不可或缺:尤其是粵語,人工智慧的輸出應由母語者審閱,才能抓出不自然的措辭、錯誤的語氣詞和普通話的干擾
  4. 留意語域:決定你的目標文本應該是正式書面中文(書面語),還是口語化的書面粵語(粵語白話文),因為這是兩種非常不同的語域

常見陷阱

無論你是翻譯人員、語言學習者,還是正拓展中文市場的企業,以下是應避免的最常見錯誤:

陷阱1:把「中文」當成單一語言

最常見的錯誤,就是假設普通話翻譯能適用於所有中文使用者。以普通話簡體中文撰寫的行銷活動,在香港受眾眼中會顯得陌生,不只是因為字形,還因為詞彙、成語與文化引用。

陷阱2:以為轉換漢字就足夠

把簡體字轉成繁體字(或反之)並不等同於在普通話與粵語之間翻譯。即使在普通話內部,台灣使用的繁體中文在詞彙與措辭上也與香港使用的繁體中文不同。中國大陸的「软件」(ruǎnjiàn,意為「軟體」)在香港變成 軟件,在台灣則變成 軟體(ruǎntǐ)——相同的文字系統,卻是完全不同的詞。

陷阱3:忽略粵語的句尾語氣詞

如果你的粵語譯文讀起來像是轉換過的普通話,卻缺少適當的句尾語氣詞,母語者會覺得生硬不自然。這些語氣詞不是可有可無的裝飾——它們是粵語傳達意義與情感的核心。

陷阱4:使用錯誤的羅馬拼音

普通話的人名與術語應使用漢語拼音。粵語的人名與術語,尤其是香港地名與人名,遵循不同的羅馬拼音慣例。同樣的字「陳」在普通話拼音中是 “Chén”,在粵語中則是 “Chan”。在專業場合弄錯這一點,會顯示出缺乏文化敏感度。

陷阱5:忽略地區詞彙

即使簡單的日常詞彙也不相同。如果你的普通話譯文用「出租車」(chūzūchē)表示 “taxi”,香港讀者期待的是「的士」(dik1si2,借自英語 “taxi”)。在香港內容中使用大陸詞彙——或反之——會立刻讓文本被標記為本地化不佳。

陷阱6:以為年輕使用者不在乎

雖然年輕的香港居民日益精通普通話,這並不表示他們偏好普通話內容。粵語仍是香港認同的強烈標誌,在預期使用粵語的場合使用普通話,可能顯得缺乏敏感度,尤其在廣告與社群媒體上。

快速參考速查表

特徵普通話粵語
母語使用者約9.33億約8,500萬
聲調4個(+1輕聲)6個(傳統上9個)
書寫系統簡體(大陸)、繁體(台灣)繁體
羅馬拼音漢語拼音粵拼
官方地位中國、台灣、新加坡、聯合國香港、澳門(實際上)
「你好」你好 (nǐ hǎo)你好 (nei5 hou2)
「謝謝」謝謝 (xièxie)多謝 (do1 ze6) / 唔該 (m4 goi1)
「你好嗎?」你好嗎?(nǐ hǎo ma?)你好嗎?(nei5 hou2 maa3?)
「我不明白」我不明白 (wǒ bù míngbai)我唔明 (ngo5 m4 ming4)
「好吃」好吃 (hǎochī)好食 (hou2 sik6)
「再見」再見 (zàijiàn)拜拜 (baai1 baai3)
人工智慧翻譯支援極佳有限
主要學習資源HSK 架構、Pleco、HelloChinese無標準化架構、Pleco、Drops

工具與資源

普通話

  • HSK(漢語水平考試):標準化的普通話能力測驗,全球廣泛認可
  • Pleco:黃金標準的中文辭典應用程式,對普通話的支援極佳
  • HelloChinese / Duolingo:以結構化方式學習普通話的熱門應用程式
  • MDBG:一套完整的線上中英辭典
  • The Chairman’s Bao:為普通話學習者設計的分級閱讀材料

粵語

  • Pleco 搭配粵語外掛:包含粵拼發音與粵語專用釋義
  • Drops:提供專門的粵語課程
  • Cantonese Class 101:結構化的音訊與視訊課程
  • words.hk(粵典):一套由社群建構、附有用法範例的粵語辭典
  • Hambaanglaang:提供附粵語標註文本的協作計畫

翻譯

  • OpenL:支援多種中文變體,提供可指定變體選項的人工智慧翻譯,讓你能更準確地處理普通話與粵語內容
  • Google Translate:普通話支援強大(簡體與繁體),但不支援粵語作為獨立選項
  • DeepL:普通話品質極佳,不支援粵語

結語

普通話與粵語是兩種截然不同的語言,卻共用一套書寫系統與文化遺產。把它們視為可互換會導致溝通失誤。普通話讓你接觸到地球上最大的單一語言受眾;粵語則為你打開香港、澳門,以及在商業、媒體與文化上具有超額影響力的全球離散社群之門。

人工智慧的發展現況也反映了這道分野:普通話有現代工具完善支援,粵語卻仍未被充分重視。隨著評測基準改善、訓練資料擴充,差距將會縮小——但就目前而言,粵語內容仍需人工專業知識參與其中。

無論你是在為應用程式做本地化、為電影製作字幕,還是想不通為什麼你的「中文」翻譯沒有打動人心,本指南中的這些區別就是你的起點。中文世界並非鐵板一塊,你的翻譯策略也不該如此。