普通話與粵語:每位翻譯人員都該知道的關鍵差異
TABLE OF CONTENTS
普通話與粵語常被籠統地歸為同一種「中文」,但兩者的互通程度其實大約就像葡萄牙語與義大利語——同源、共用一套書寫系統,聽起來卻截然不同。
前言
若問一位不熟悉東亞的人「中文」到底有幾種語言,你大概會聽到「一種」。實際上,中國境內存在著一個彼此相關卻各自獨立的語言家族,其中最知名的兩種是普通話(Pǔtōnghuà)與粵語(Gwóngdūngwá)。
普通話約有9.33億母語使用者,是中國、台灣與新加坡的官方語言。粵語約有8,500萬母語使用者——比德國全國人口還多——在香港、澳門、廣東省以及全球各地海外華人社區中佔主導地位。
對鎖定中文受眾的翻譯人員與企業而言,理解這些差異至關重要。普通話翻譯在香港會完全失準。人工智慧翻譯工具處理這兩種語言的方式也大不相同。本指南涵蓋所有主要差異:聲調、書寫系統、語法、地區使用情況,以及人工智慧翻譯的挑戰。
快速決策框架
在深入語言細節之前,這裡提供一套實用的框架,幫助你決定需要哪一種中文:
如果你符合以下情況,請選擇普通話:
- 目標受眾位於中國大陸、台灣或新加坡
- 與中國政府機關或國有企業往來
- 為盡可能最大的中文受眾製作教育內容
- 為一般中文市場開發應用程式或網站
如果你符合以下情況,請選擇粵語:
- 目標受眾位於香港或澳門
- 為北美、英國或澳洲的海外華人社區進行內容本地化
- 與粵語媒體合作(香港電影、粵語流行曲)
- 翻譯根植於中國南方的歷史或文化文本
如果你符合以下情況,可能會兩者都需要:
- 執行泛中文行銷活動
- 為大中華地區的使用者建立客戶支援系統
- 為同時在中國大陸與香港發行的媒體製作字幕
聲調與發音
普通話與粵語的聲調系統,或許是兩者之間最立即顯著的差異。兩者都是有聲調的語言——意思是發音時使用的音高模式會完全改變音節的意義——但兩者在複雜度上差異極大。
普通話的四個聲調
普通話有四個主要聲調,外加一個輕聲(不重讀)聲調:
| 聲調 | 名稱 | 音高模式 | 範例 | 意義 |
|---|---|---|---|---|
| 第一聲 | 高平 | 高而平 | mā (媽) | 母親 |
| 第二聲 | 上升 | 中到高 | má (麻) | 大麻 |
| 第三聲 | 下降後上升 | 中低,然後上升 | mǎ (馬) | 馬 |
| 第四聲 | 下降 | 高到低 | mà (罵) | 責罵 |
| 輕聲 | 輕 | 短、不重讀 | ma (嗎) | 疑問語氣詞 |
這四個聲調的輪廓相對分明——一條平線、一條上升線、一個下凹,以及一段急降——對初學者來說相對容易分辨。
粵語的六個聲調
粵語在現代標準用法中有六個聲調(傳統分析最多計為九個,但三個「入聲」與第1、3、6聲共用音高模式,差別只在於以塞音收尾):
| 聲調 | 音高模式 | 粵拼編號 | 範例 | 意義 |
|---|---|---|---|---|
| 高平 | 高而平 | 1 | sī (詩) | 詩 |
| 中升 | 中到高 | 2 | sí (史) | 歷史 |
| 中平 | 中而平 | 3 | si (試) | 嘗試 |
| 低降 | 低,略微下降 | 4 | sìh (時) | 時間 |
| 低升 | 低到中 | 5 | síh (市) | 市場 |
| 低平 | 低而平 | 6 | sih (是) | 是(to be) |
粵語聲調的挑戰在於,其中三個(第1、3、6聲)都是平調——既不上升也不下降——差別僅在於音高高低。對非母語者而言,要分辨「高平」與「中平」,需要比分辨普通話的上升聲與下降聲更多的聽力訓練。
子音與母音差異
除了聲調之外,兩種語言的語音系統也有相當大的差異:
- 普通話有粵語所沒有的翹舌音(zh、ch、sh、r)
- 粵語有普通話所沒有的聲母,例如 ng-、kw- 和 gw-
- 粵語保留了中古漢語的韻尾塞音(-p、-t、-k),而普通話已完全丟失
- 粵語有更豐富的母音系統,包含更多雙母音和三母音
- 普通話的音節結構較簡單,通常由聲母、母音和可選的鼻音韻尾(-n 或 -ng)組成
這些差異意味著粵語約有1,760個不同音節,而普通話約有1,300個——這也是粵語與古典漢詩保留更多語音連結的原因之一。
羅馬拼音系統
- 普通話使用漢語拼音(拼音),於1950年代制定:Běijīng (北京)
- 粵語使用粵拼(Jyutping),由香港語言學學會制定:Bak1ging1 (北京)
書寫系統:簡體與繁體
對翻譯人員來說,最實際的差異之一就是書寫系統。雖然普通話與粵語共用同一套底層漢字,但兩者通常使用不同的標準字形。
繁體字
繁體字是歷史更悠久、結構更複雜的字形,已使用數千年。它們從古代的甲骨文,歷經篆書與隸書演變,約在西元5世紀達到現代形態。
使用地區: 香港、澳門、台灣,以及大多數海外華人社區
範例: 「龍」字的繁體形是 龍(16畫)。
簡體字
1949年中華人民共和國成立時,識字率約為20%。1950至60年代,政府簡化了約2,000個漢字,讓閱讀與書寫更容易。
使用地區: 中國大陸、新加坡、馬來西亞
範例: 同一個「龍」字的簡體形是 龙(5畫)。
翻譯人員需知的關鍵差異
| 面向 | 簡體 | 繁體 |
|---|---|---|
| 筆畫數 | 較少(通常減少30-60%) | 較多(原始的複雜度) |
| 漢字合併 | 一個字可能對應多個繁體字 | 一對一的意義 |
| 主要地區 | 中國大陸、新加坡、馬來西亞 | 香港、澳門、台灣 |
| 數位輸入 | 標準輸入法同時支援兩種系統 | 兩種系統皆支援 |
| 詞彙 | 部分用詞不同(例如以 软件 表示「軟體」) | 部分用詞不同(例如香港用 軟件,台灣用 軟體) |
一個重要的細節:簡體/繁體的區分並不完全等同於普通話/粵語。台灣使用繁體字書寫普通話;新加坡使用簡體字。然而實際上,粵語內容幾乎總是使用繁體字(因為它主要在香港與澳門以書面形式呈現)。
粵語專用字
粵語有一些標準書面中文(以普通話語法為基礎)中沒有的字。這些字在香港的非正式書寫、簡訊和社群媒體中廣泛使用:
- 嘅 (ge3) — 所有格助詞(相當於普通話的 的)
- 係 (hai6) — 「是」(相當於普通話的 是)
- 唔 (m4) — 否定(相當於普通話的 不)
- 佢 (keoi5) — 「他/她/它」(相當於普通話的 他/她/它)
- 嗰 (go2) — 「那」(相當於普通話的 那)
- 冇 (mou5) — 「沒有」(相當於普通話的 沒有)
這些字對未針對粵語專用 Unicode 範圍最佳化的翻譯工具構成挑戰。
語法比較
普通話與粵語共用相同的基本句型——主詞-動詞-受詞(SVO)——而且兩種語言都沒有語法性別、名詞格變化或動詞變化。然而,兩者之間仍存在若干重要的語法差異。
語序差異
雖然兩者都遵循 SVO 語序,但某些結構的運作方式有明顯變化:
間接受詞:
- 普通話:我給你一本書 (Wǒ gěi nǐ yī běn shū) — 「我給你一本書」(動詞 + 間接受詞 + 直接受詞)
- 粵語:我畀一本書你 (ngo5 bei2 jat1 bun2 syu1 nei5) — 「我給你一本書」(動詞 + 直接受詞 + 間接受詞)
比較結構:
- 普通話:他比我高 (Tā bǐ wǒ gāo) — 「他比我高」(比較對象 + 形容詞)
- 粵語:佢高過我 (keoi5 gou1 gwo3 ngo5) — 「他比我高」(形容詞 + 超過標記)
句尾語氣詞
這正是粵語與普通話真正分道揚鑣之處。兩種語言都使用句尾語氣詞——加在句子末尾、用來表達語氣、態度或語法功能的小音節——但粵語的系統遠為複雜精細。
普通話約有7到17個常用句尾語氣詞,包括:
- 嗎 (ma) — 是非問句標記
- 呢 (ne) — 追問或延續
- 吧 (ba) — 建議或推測
- 了 (le) — 狀態改變或動作完成
- 啊 (a) — 緩和語氣或感嘆
粵語至少有30個基本句尾語氣詞,研究者記錄到的變體形式超過200種。一些常用例子包括:
- 呀 (aa3) — 緩和語氣,讓陳述聽起來自然
- 㗎 (gaa3) — 強調,「你知道的」
- 喎 (wo3) — 驚訝或新資訊
- 囉 (lo1) — 「當然」,「本來就是這樣」
- 啦 (laa1) — 催促或建議
- 嘅 (ge3) — 斷言或確認
- 咩 (me1) — 驚訝的疑問,「真的嗎?」
粵語語氣詞特別複雜的地方在於它們可以堆疊——兩三個語氣詞串在一起,每個都增添一層細微差異。它們也能透過延長音長和改變音高來進一步修飾意義。這套語氣詞系統對粵語如此重要,以至於香港使用者經常在日常英語句子中夾入粵語語氣詞。
體貌標記
兩種語言都會標記動詞的體貌(動作是完成、進行中,還是曾經歷過),但使用的標記不同:
| 體貌 | 普通話 | 粵語 |
|---|---|---|
| 完成動作 | 了 (le) | 咗 (zo2) |
| 進行中的動作 | 在 (zài) / 正在 (zhèngzài) | 緊 (gan2) |
| 過去經驗 | 過 (guò) | 過 (gwo3) |
| 持續 | 著 (zhe) | 住 (zyu6) |
詞彙差異
即使表達同一個概念,普通話與粵語也常使用完全不同的詞:
| 英文 | 普通話 | 粵語 |
|---|---|---|
| 吃 | 吃 (chī) | 食 (sik6) |
| 看 | 看 (kàn) | 睇 (tai2) |
| 說 | 說 (shuō) | 講 (gong2) |
| 想 | 想 (xiǎng) | 諗 (nam2) |
| 東西 | 東西 (dōngxi) | 嘢 (je5) |
| 什麼 | 什麼 (shénme) | 乜嘢 (mat1 je5) |
| 很 | 很 (hěn) | 好 (hou2) |
| 不 | 不 (bù) | 唔 (m4) |
| 跑 | 跑 (pǎo) | 走 (zau2) |
| 漂亮 | 漂亮 (piàoliang) | 靚 (leng3) |
這些不只是口音或方言的差異——它們是詞源不同的根本相異詞彙,可類比為西班牙語的 “hablar” 與葡萄牙語的 “falar” 之間的差別。
地區使用情況與地位
普通話的主導地位
普通話是中華人民共和國唯一的官方語言,正式名稱為 Pǔtōnghuà(普通話,意為「共通語」)。中國政府推行強勢的推廣政策:到2020年,約80%的中國人口能說普通話,目標是2025年達到85%。普通話同時也是:
- 台灣的官方語言(稱作 Guóyǔ 國語)
- 新加坡四種官方語言之一
- 聯合國六種官方語言之一
- 全球最多人學習的中文變體,擁有數百萬名外國學習者
粵語的根據地
儘管使用人數少得多,粵語在若干地區依然極其重要:
- 香港:750萬人口中有88.2%以粵語為主要語言(2021年人口普查)
- 澳門:粵語是使用最廣泛的語言,約80%人口使用
- 廣東省:粵語的歷史核心地帶,人口超過1.2億——儘管普通話在年輕世代中日益佔主導地位
- 廣西省:南部地區使用粵語,尤其是梧州與南寧一帶
全球離散社群
由於早期中國移民潮(19世紀至20世紀初)大多來自廣東,粵語成為海外華人社區中的主導中文語言:
- 加拿大:565,275名居民通報粵語為母語(2016年人口普查)
- 美國:在三藩市、紐約與洛杉磯有大型社區
- 英國:倫敦與曼徹斯特有大型社區
- 澳洲:雪梨與墨爾本有相當規模的社區
- 東南亞:馬來西亞、越南、柬埔寨與泰國的華人社區使用粵語
承受壓力的語言
粵語在其傳統根據地面臨日益增長的壓力。在廣東,大規模移民與普通話推廣已減少年輕居民的使用。在香港,自1997年回歸以來對普通話日益重視,引發了對粵語未來的擔憂。
然而,粵語仍與香港的文化認同、粵語流行曲,以及全球產量最豐富的電影產業之一緊密相連——確保了對粵語翻譯與本地化的持續需求。
人工智慧翻譯的挑戰
對任何使用人工智慧翻譯工具的人來說,普通話與粵語之間的分野帶來了一些獨特且往往令人挫折的挑戰。
普通話:資源充足,但並非完美
普通話是人工智慧翻譯中支援最完善的語言之一。Google Translate、DeepL 以及大多數主要翻譯平台都提供穩健的普通話支援。然而,挑戰依然存在:
- 簡體與繁體的轉換並非單純的字形替換——中國大陸、台灣與新加坡之間的詞彙、措辭與文化引用各不相同
- 文言文典故與現代文本中的文學隱喻可能讓人工智慧模型出錯
- 依賴語境的字:字「了」可以作為動作完成標記、狀態改變語氣詞,或複合詞的一部分——人工智慧系統有時會誤判它扮演的角色
- 語域與正式程度:中文的正式書面語與口語之間差異顯著,人工智慧工具可能無法一致地處理
粵語:低資源語言
儘管有8,500萬使用者——比義大利語、韓語或荷蘭語還多——粵語在人工智慧翻譯領域仍被歸類為「低資源語言」。這造成了重大問題:
工具支援有限:截至2025年,Google Translate 並未將粵語列為獨立的語言選項。大多數主要翻譯平台都把「中文」等同於普通話,讓粵語使用者得不到充分服務。
訓練資料稀缺:NAACL 2025 的研究顯示,大型語言模型在粵語任務上的表現明顯不如普通話。可取得的訓練資料有限、嘈雜,且偏向正式文本。
書面粵語的複雜性:以普通話訓練的人工智慧模型,常因粵語獨特的字與語法而產生不自然的輸出。
語言混淆:模型有時會把粵語與普通話或日語搞混。研究者曾記錄粵語文本被錯誤翻譯成日語片假名的案例。
語碼混用:來自香港的真實粵語文本經常混合粵語、英語與普通話——對使用者來說很自然,對人工智慧卻極具挑戰。
這對翻譯人員意味著什麼
如果你在處理粵語內容,單靠人工智慧翻譯是有風險的。最佳實務包括:
- 務必指定目標變體:不要假設「中文」就是你要的。明確指定你需要普通話(簡體或繁體)還是粵語
- 使用專門工具:像 OpenL 這類支援多種中文變體的工具,能比一般用途的翻譯器產出更準確的結果
- 人工審閱不可或缺:尤其是粵語,人工智慧的輸出應由母語者審閱,才能抓出不自然的措辭、錯誤的語氣詞和普通話的干擾
- 留意語域:決定你的目標文本應該是正式書面中文(書面語),還是口語化的書面粵語(粵語白話文),因為這是兩種非常不同的語域
常見陷阱
無論你是翻譯人員、語言學習者,還是正拓展中文市場的企業,以下是應避免的最常見錯誤:
陷阱1:把「中文」當成單一語言
最常見的錯誤,就是假設普通話翻譯能適用於所有中文使用者。以普通話簡體中文撰寫的行銷活動,在香港受眾眼中會顯得陌生,不只是因為字形,還因為詞彙、成語與文化引用。
陷阱2:以為轉換漢字就足夠
把簡體字轉成繁體字(或反之)並不等同於在普通話與粵語之間翻譯。即使在普通話內部,台灣使用的繁體中文在詞彙與措辭上也與香港使用的繁體中文不同。中國大陸的「软件」(ruǎnjiàn,意為「軟體」)在香港變成 軟件,在台灣則變成 軟體(ruǎntǐ)——相同的文字系統,卻是完全不同的詞。
陷阱3:忽略粵語的句尾語氣詞
如果你的粵語譯文讀起來像是轉換過的普通話,卻缺少適當的句尾語氣詞,母語者會覺得生硬不自然。這些語氣詞不是可有可無的裝飾——它們是粵語傳達意義與情感的核心。
陷阱4:使用錯誤的羅馬拼音
普通話的人名與術語應使用漢語拼音。粵語的人名與術語,尤其是香港地名與人名,遵循不同的羅馬拼音慣例。同樣的字「陳」在普通話拼音中是 “Chén”,在粵語中則是 “Chan”。在專業場合弄錯這一點,會顯示出缺乏文化敏感度。
陷阱5:忽略地區詞彙
即使簡單的日常詞彙也不相同。如果你的普通話譯文用「出租車」(chūzūchē)表示 “taxi”,香港讀者期待的是「的士」(dik1si2,借自英語 “taxi”)。在香港內容中使用大陸詞彙——或反之——會立刻讓文本被標記為本地化不佳。
陷阱6:以為年輕使用者不在乎
雖然年輕的香港居民日益精通普通話,這並不表示他們偏好普通話內容。粵語仍是香港認同的強烈標誌,在預期使用粵語的場合使用普通話,可能顯得缺乏敏感度,尤其在廣告與社群媒體上。
快速參考速查表
| 特徵 | 普通話 | 粵語 |
|---|---|---|
| 母語使用者 | 約9.33億 | 約8,500萬 |
| 聲調 | 4個(+1輕聲) | 6個(傳統上9個) |
| 書寫系統 | 簡體(大陸)、繁體(台灣) | 繁體 |
| 羅馬拼音 | 漢語拼音 | 粵拼 |
| 官方地位 | 中國、台灣、新加坡、聯合國 | 香港、澳門(實際上) |
| 「你好」 | 你好 (nǐ hǎo) | 你好 (nei5 hou2) |
| 「謝謝」 | 謝謝 (xièxie) | 多謝 (do1 ze6) / 唔該 (m4 goi1) |
| 「你好嗎?」 | 你好嗎?(nǐ hǎo ma?) | 你好嗎?(nei5 hou2 maa3?) |
| 「我不明白」 | 我不明白 (wǒ bù míngbai) | 我唔明 (ngo5 m4 ming4) |
| 「好吃」 | 好吃 (hǎochī) | 好食 (hou2 sik6) |
| 「再見」 | 再見 (zàijiàn) | 拜拜 (baai1 baai3) |
| 人工智慧翻譯支援 | 極佳 | 有限 |
| 主要學習資源 | HSK 架構、Pleco、HelloChinese | 無標準化架構、Pleco、Drops |
工具與資源
普通話
- HSK(漢語水平考試):標準化的普通話能力測驗,全球廣泛認可
- Pleco:黃金標準的中文辭典應用程式,對普通話的支援極佳
- HelloChinese / Duolingo:以結構化方式學習普通話的熱門應用程式
- MDBG:一套完整的線上中英辭典
- The Chairman’s Bao:為普通話學習者設計的分級閱讀材料
粵語
- Pleco 搭配粵語外掛:包含粵拼發音與粵語專用釋義
- Drops:提供專門的粵語課程
- Cantonese Class 101:結構化的音訊與視訊課程
- words.hk(粵典):一套由社群建構、附有用法範例的粵語辭典
- Hambaanglaang:提供附粵語標註文本的協作計畫
翻譯
- OpenL:支援多種中文變體,提供可指定變體選項的人工智慧翻譯,讓你能更準確地處理普通話與粵語內容
- Google Translate:普通話支援強大(簡體與繁體),但不支援粵語作為獨立選項
- DeepL:普通話品質極佳,不支援粵語
結語
普通話與粵語是兩種截然不同的語言,卻共用一套書寫系統與文化遺產。把它們視為可互換會導致溝通失誤。普通話讓你接觸到地球上最大的單一語言受眾;粵語則為你打開香港、澳門,以及在商業、媒體與文化上具有超額影響力的全球離散社群之門。
人工智慧的發展現況也反映了這道分野:普通話有現代工具完善支援,粵語卻仍未被充分重視。隨著評測基準改善、訓練資料擴充,差距將會縮小——但就目前而言,粵語內容仍需人工專業知識參與其中。
無論你是在為應用程式做本地化、為電影製作字幕,還是想不通為什麼你的「中文」翻譯沒有打動人心,本指南中的這些區別就是你的起點。中文世界並非鐵板一塊,你的翻譯策略也不該如此。


