在中國大陸普通話(普通話)、馬來西亞華語(馬來西亞華語)和新加坡華語(Singdarin)之間互相轉換。處理外來詞、語氣詞和語序模式。新馬華語普通話轉換。
Malaysian & Singaporean Mandarin Converter
如何使用新馬華語轉換器
選擇方向
默認是 大陸 → 馬來西亞。下拉菜單提供 六個方向,涵蓋大陸(普通話)、馬來西亞(馬來西亞華語)和新加坡(Singdarin)華語的所有組合——包括兩個跨東盟模式(my↔sg,經由大陸中轉)。
調整語氣詞強度
黃色滑塊控制添加多少句末語氣詞(啦/咯/咩/leh/lah)。濃聽起來像吉隆坡或檳城大叔在講故事;無則給出只改詞彙的輸出。默認為 自然——自然的對話語域。
輸入或粘貼你的文本
最多 5,000 字。輸入時即時轉換(去抖約 220 毫秒)。輸出會高亮每一處改動的詞和注入的語氣詞——把鼠標懸停在任一高亮上即可看到原文。
找出差異所在
珊瑚色高亮標記詞彙替換(例如 出租車 → 德士)。琥珀色高亮標記注入的語氣詞。統計行會顯示改動總數。同樣的輸入在連續運行時可能產生略有不同的輸出——語氣詞的選擇是概率性的。
為什麼説馬來西亞華語和新加坡華語是自成一體的變體
人們常有一個誤解,以為華語(普通話)是一種完全統一的語言——以為身處北京、吉隆坡和新加坡的人講的是一模一樣的東西。實際情況更接近英式英語和美式英語之間的關係:彼此能聽懂,核心詞彙大多相通,但差異又足夠明顯,使得一段持續的對話會把分別暴露得一清二楚。約有 800 萬馬來西亞人每天使用馬來西亞華語,約 60 萬新加坡人把新加坡華語(Singdarin)當作主要或並列主要的語言。與中國大陸分隔了七十年,再加上與馬來語、英語、福建話、潮州話和粵語的密切接觸,共同孕育出了新馬華語——一個有着自己詞彙、語法和句末語氣詞的、自成一體的變體。
標準化的情況很有意思。馬來西亞是中國以外唯一擁有政府支持的華語規範機構的國家:馬來西亞華語規範理事會(語範,規範馬來西亞華語理事會)積極規範正式的書面語言。本地媒體在新聞報道中使用標準華語。但日常口語,就是當地人親切地稱之為羅惹華語的東西——一盤由華語、華南方言、馬來語和英語拌成的雜燴沙拉。大多數馬來西亞和新加坡華人都能根據場合在正式語域和羅惹語域之間流暢切換——這是一種從小在其中長大便習以為常的雙層語言現象。
"馬來西亞華語在約 3,500–4,000 個詞彙上與大陸普通話存在分歧,同時共享 70–75% 的核心詞彙——這使它能夠互通,卻又自成一體,擁有 800 萬日常使用者。" —— 綜合自馬來西亞華語規範理事會標準與《馬來西亞華語特有詞語詞典》(2,250 個有據可查的詞條)
三個層面的差異
詞彙層面:馬來語外來詞最為顯眼——巴剎源自 pasar(市場)、甘榜源自 kampung(村莊)、嘛嘛檔源自泰米爾語 mamak(印度裔穆斯林攤檔)。英語外來詞同樣常見:德士(taxi)、羅釐(lorry)、巴仙(per cent)、摩多(motor)。還有本地新造的華語詞:組屋指新加坡的 HDB 公共住房、擁車證指新加坡購車的擁車證、拿督 / 丹斯里 / 敦 指馬來西亞的聯邦封銜。大陸人説 出租車 的地方,馬來西亞或新加坡人會説 德士。大陸人説 警察 的地方,一些年長的馬來西亞人仍會説 馬打——這是從馬來語 mata-mata 借來的。
句法層面(語法和語氣詞):粵語重塑了新馬華語口語的語序。大陸普通話把副詞放在動詞前面——我先吃(「我首先吃」)——而馬來西亞華語口語卻把它倒過來:我吃先,正是經典的粵語模式。而句末語氣詞則是這個變體的靈魂:啦、咯、咩、咧,以及在夾雜 Singlish 的語域中書寫時的羅馬字 leh、lah、lor。它們散落在隨意的對話裏:好的 變成 好咯 或 好啦;是嗎 變成 是咩。沒有語氣詞,同樣的華語詞在本地人耳中會顯得僵硬、「太中國了」。本轉換器的語氣詞強度滑塊讓你精確調出口語語域該有多濃。
文化層面
文化層面(無法直譯的概念):有些新馬華語詞承載着抗拒翻譯的文化分量。怕輸(kiasu,字面意為「怕輸」)是新加坡的標誌性概念——它已作為外來詞被收入英語詞典,自成一詞。嘛嘛檔指的是一種 24 小時營業的、印度裔穆斯林經營的特定攤檔,這在中國大陸根本不存在。紅毛(「紅頭髮」)在一些馬來西亞華人社羣中仍被口語化地用來稱呼西方人。本轉換器直接處理前兩個層面——詞彙和語氣詞。文化層面則原樣保留,以免丟失意義。
這個工具為何能坦誠面對自己的侷限
直白地承認:這是一個第一階段的工具。它把一部精選詞典(v1.0 約 100 條高可信度詞條)與一條概率性的語氣詞注入規則,以及三種受粵語影響的語序模式配搭在一起。在簡短常用短語上,它的準確度約為 70%——足以用於日常聊天的轉換、順便學習最常見的替換,或為面向東盟的營銷生成「有馬來西亞味」「有新加坡味」的文案。它做不到的:處理語碼轉換(「Eh, the 巴剎 ada open or not?」)、檳城特有的華語(馬來西亞內部的地區差異)、世代差異(年長使用者用更多受福建話影響的詞),或歌詞。對於這些,基於 LLM 的會員版會妥善處理。新加坡人用來辨認馬來西亞華語使用者的「聯邦腔」這個暱稱道出了一個事實:這些變體的分別足夠大,即便在東盟之內,使用者也能彼此分辨——而本工具幫助把這些分別呈現給大陸讀者。
關於馬來西亞與新加坡華語,你應該知道的 10 件事
800 萬日常使用者. 馬來西亞華語約有 800 萬日常使用者——總使用人數超過挪威語、芬蘭語或丹麥語,並且隨着全球華人僑民的擴散而不斷增長。
70–75% 詞彙相通. 馬來西亞/新加坡華語與大陸普通話共享大部分核心詞彙——但在約 3,500–4,000 個日常用詞上存在分歧,足以讓一段持續的對話聽起來明顯不同。
設有官方規範機構. 馬來西亞的馬來西亞華語規範理事會(語範)積極規範馬來西亞華語詞彙——這是中國以外唯一同類型的政府機構。
當地暱稱叫「羅惹華語」. Rojak 是一種拌花生醬的馬來西亞沙拉——這個比喻完美捕捉了華語、福建話、粵語、馬來語和英語在語言上的交融。
新加坡造出了「Singdarin」. 新加坡這種口語化的華語變體有自己被維基百科收錄的英文名稱——有別於新聞廣播中使用的正式新加坡華語。
粵語重塑了語法. 你吃先(粵語語序)在馬來西亞華語口語中取代了你先吃——尤其在歷來以粵語為主的吉隆坡。
馬來語外來詞已是規範用詞. 巴剎(pasar/市場)、甘榜(kampung/村莊)、嘛嘛檔(mamak/印度裔穆斯林攤檔)都是被接受的馬來西亞華語詞彙——收錄於《馬來西亞華語特有詞語詞典》。
英語外來詞並存. 德士(taxi)、羅釐(lorry)、巴仙(percent)、摩多(motor)——全都是從英語詞根「華語化」而來,而非從普通話原詞新造。
「聯邦腔」是個真實説法. 新加坡人用這個暱稱(「聯邦腔」)來辨認講馬來西亞華語的人——這是一個真實的社會語言學標記,而非刻板印象。
標準參考詞典. 《馬來西亞華語特有詞語詞典》收錄了 2,250 個有據可查的詞條——而日常實際使用的範圍還要更廣。
常見問題
-
差異有三個層面:詞彙(出租車 vs 德士「taxi」、公寓 vs 組屋「類似 HDB 的公共住房」、菜市場 vs 巴剎「市場」)、句末語氣詞(啦/咯/咩/leh/lah 被大量使用,而大陸普通話幾乎不用),以及語序(受粵語影響的「你吃先」vs 大陸的「你先吃」)。詞彙重合度為 70–75%,可以互通——但一段持續的對話會讓差異變得明顯。大約有 3,500–4,000 個日常用詞存在分歧。
-
關係密切,但並不相同。兩者都共享許多源自馬來語的外來詞(巴剎、甘榜)和源自英語的外來詞(德士、羅釐),也使用同一套語氣詞系統(lah/lor/leh)。但新加坡有自己的機構特有詞:組屋(HDB 公共住房)、擁車證(COE——購車的擁車證)、CPF(中央公積金)、kiasu(怕輸)。馬來西亞也有自己的:拿督 / 拿督斯里 / 敦 等封銜、首相(總理,新加坡説總理)、嘛嘛檔(24 小時營業的嘛嘛檔)。
-
它控制在輸出中往句末注入多少個語氣詞(啦、咯、咩、lah、leh、lor)。0 級 = 不加語氣詞(只改詞彙)。1 級(輕)≈ 25% 的句末會加上語氣詞。2 級(自然)≈ 55%——聽起來像日常閒聊般自然。3 級(濃)≈ 85%——聽起來像檳城/吉隆坡大叔在講故事。同樣的輸入在連續運行時可能產生略有不同的輸出,因為語氣詞的選擇是概率性的——就像真人説話本來就會變化一樣。
-
語氣詞的注入是刻意設計成概率性的。每一個句末標點(。!?)都會按滑塊設定的比率進行一次概率判定。如果命中,就會從語氣詞池中按其在該強度下「聽起來有多自然」加權挑選一個。這模擬了真實的説話方式:一個馬來西亞人不會在每一句話後面都加 啦——大約只有一半會加。重新運行轉換會產生不同的分佈。如果你想要確定性的、只改詞彙的輸出,就把滑塊設到 0 級。
-
中文轉換器處理的是書寫系統和地區詞彙(簡體 ↔ 繁體,以及大陸、台灣、香港之間的用詞差異)。它假定兩邊仍然都是普通話,只改字符/詞彙。而這個新馬華語轉換器會額外替換成東盟特有的詞彙(源自馬來語和英語的外來詞),並注入句末語氣詞——從字符轉換進一步深入到口語語域。要做大陸 → 台灣的發佈,用中文轉換器;想讓結果帶有馬來西亞或新加坡味道,就用這一個。
-
v1 版還不行。語碼轉換(在一句話裏夾雜中文、馬來語、英語,或三者兼有)是自然新馬華語中最難的部分。當前的工具處理詞彙替換和語氣詞注入,但假定輸入是純中文。對於準確的語碼轉換文本——在本地區的 WhatsApp 和 Facebook Messenger 上很常見——AI 驅動的版本(會員版,即將推出)會採用具備語境感知能力的 LLM。請訂閲上方的上線通知。
-
是的。「Singdarin」是新加坡口語化華語(新加坡華語)既定的英文名稱——被維基百科收錄,在學術語言學文獻中使用,大多數新加坡人也都知道。它特指受福建話、潮州話、粵語、馬來語和英語影響的口語/隨意變體——有別於新聞廣播和政府溝通中使用的正式新加坡華語。同樣的對應關係也存在於 Singlish(英語變體)和 Singdarin(華語變體)之間。
-
那是受粵語影響的語序模式。在大陸普通話裏,像 先(「首先」)這樣的副詞放在動詞前面:我先吃(「我先吃」)。而在馬來西亞華語口語中(尤其在歷來以粵語為主導的吉隆坡),它們放在後面:我吃先。粵語本身就用這種語序,身處粵語區的普通話便吸收了這一模式。本工具在 cn→my 和 cn→sg 方向上處理幾種常見的 先 字模式;更廣泛的語法重排則需要 AI 版本。
-
在馬來西亞和新加坡,是的——它們是標準的報章中文,在學校裏也可以使用,並被收錄於包括《馬來西亞華語特有詞語詞典》在內的地區性詞典。在中國大陸的詞典裏,它們並非標準詞——大陸讀者會認得這些字,卻不明白其含義。這和英式英語與美式英語的情況一模一樣:「lorry」「lift」「queue」在一種變體裏是標準詞,在另一種裏卻是專門詞彙。新馬華語是自成一體的變體,有自己的標準。
-
暫無確切日期——我們正在先搭建 LLM 路由、成本控制流程和質量評估套件。點擊本頁的「通知我」按鈕,即可加入上線名單。準備就緒時,我們會發送一封上線通知郵件,之後不會再有營銷跟進。AI 版本將能處理語碼轉換、複雜語法、慣用表達,以及語域調整(正式新聞 vs 隨意的 WhatsApp 閒聊)——這些正是這個基於詞典的版本老實説做不到的部分。
Related News
You may be interested in these recent stories from our newsroom.
-
AWS Commits $1 Billion to Embedded AI Engineers as the Enterprise Fight Shifts to Deployment
AWS has committed US$1 billion to a Forward Deployed Engineering organisation that embeds its engineers inside customer teams, following pri...
-
ByteDance Launches Seedream 5.0 Pro, an Image Model That Outputs Editable Layers
ByteDance has launched Seedream 5.0 Pro, a professional image-generation and editing model that breaks a single render into more than ten ed...
-
Mira Murati's Thinking Machines Releases Inkling, Its First Open-Weight Model
Mira Murati's Thinking Machines has released Inkling, its first model: an open-weight, multimodal Mixture-of-Experts system with 975 billion...