聊天模型為何改變了翻譯
傳統翻譯工具轉換的是文字和句子。它們速度快,也常常準確,但它們不接受任何指令。你沒辦法告訴它們讀者是你的老闆、語氣要保持俏皮、法律術語必須保留英文,或問候語要貼合日本人實際開頭寫信的方式。而AI聊天模型恰好能接受這些指令。
這就是實際的差別。有了ChatGPT、Claude或Gemini,翻譯變成了一場對話:你解釋情境,模型針對那個情境翻譯,你還能問它為什麼選了某個措辭,或要求一個更正式的版本。對於任何語氣和背景很重要的場合,比如傳訊息給別人、求職申請和客戶郵件,這種靈活性勝過逐字轉換。
專用工具仍有它們的位置。要即時翻譯一塊路牌、一份菜單,或一個你只想抓大意的網頁,傳統的翻譯應用程式更快。下面的比較段落,會誠實拆解每個選項各自何時勝出。
得到自然譯文的提示詞模式
一份生硬的譯文和一份自然的譯文之間的差別,幾乎總是在指令上。用這個模式,並依需要調整:
「把下面這段文字翻譯成[語言]。讀者:[誰會讀它,以及你們的關係]。語域:[正式、中性或非正式,以及要遵循的任何當地慣例]。保持不變:[人名、產品術語、技術詞彙]。譯文之後,列出任何含糊或你做過文化調整的片語,並各用一行解釋你的選擇。文字:[貼上]。」
有三個細節會不斷出現。對於有敬語層級的語言,點明你想要的形式,比如西班牙語的usted或tú、德語的Sie或du、法語的vous或tu,以及日語和韓語裡的禮貌體或隨意體。對於慣用語,請模型意譯而不是直譯,否則那個笑話到了目的地就會變成一具屍體。對於任何面向客戶的內容,加一句「讓它讀起來像母語者寫的,而不是翻譯出來的」。
你也可以反過來用:把一則你收到的外語訊息貼上,問它說了什麼、帶著什麼語氣,以及在那個文化裡,禮貌的回覆通常會是什麼樣子。新手很少用到這一招。準確理解收到的訊息,是AI翻譯價值的一半。
翻譯文件和PDF
現代AI聊天應用程式接受檔案上傳,這把文件翻譯從一場複製貼上的馬拉松,變成了一個簡短的工作流程。
- 上傳文件並說明它是什麼:一份租屋合約、一張文憑、一本產品手冊。背景會改變用字。
- 要求譯文保持和原文相同的結構:保留標題、編號和表格,好讓你能並排比對。
- 對於長文件,分節進行,並先要一份術語表:「列出反覆出現的關鍵術語,以及你將如何翻譯每一個,然後等我確認。」用語一致,正是專業翻譯和業餘翻譯的分野。
- 最後加上:「列出這份文件裡,非母語讀者可能會誤解的任何地方,以及任何你拿不準的地方。」
有兩個限制要留意。第一,聊天機器人翻譯的官方文件不是經過認證的翻譯;簽證機構和法院通常要求宣誓翻譯員,所以用AI來看懂文件、準備草稿,而不是用來提交。第二,對於非常長的檔案,模型可能在中間段落丟失一致性,而這正是術語表這一步和逐節翻譯所要防止的。我們的PDF總結指南更深入地說明了上傳工作流程。
AI聊天對比Google翻譯和DeepL:一次誠實的比較
每個選項都有它的位置。這張表反映的是新手實際的體驗,而不是廠商的宣稱。
| 情境 | 最佳選項 | 原因 |
|---|---|---|
| 路牌、菜單、快速抓大意 | 傳統翻譯應用程式 | 即時、支援相機輸入、可離線使用 |
| 個人和商務訊息 | AI聊天模型 | 遵循語氣、讀者和正式度的指令 |
| 術語固定的文件 | AI聊天模型 | 可控制術語表,結構一致 |
| 主流歐洲語言之間的長篇正式文字 | DeepL或AI聊天 | 兩者都強;就你的文字比一比 |
| 稀有語言配對 | 兩個都測 | 品質參差不齊;跑一次回譯查核 |
| 經認證的官方翻譯 | 人工宣誓翻譯員 | 多數國家的法律要求 |
關於準確性:對主流語言而言,現代聊天模型在日常文字上的翻譯水準,多數讀者已經分不出它和一位稱職的人類譯者有什麼差別。品質會在稀有語言配對、大量俚語和專業術語上下滑,而那正是下一節裡查核工作流程最重要的地方。而且因為模型的表現因語言配對而異,那個西班牙語出色的模型,泰語可能只是普普通通。就你實際的語言配對做五分鐘的並排比較,正是Whizi的並排檢視所為之打造的功能,能一勞永逸地回答這個問題。
如何查核一份你讀不懂的譯文
翻譯成一種你不會說的語言,讓人不安的地方在於你無法判斷結果。你仍然能用三種只花幾分鐘的查核來驗證它。
回譯是主力做法。開一段新對話,最好用一個不同的模型,貼上譯文,要求它翻回你的語言,並附上對語氣的描述。如果意思在這趟往返中保留下來,語氣也符合你原本的用意,嚴重錯誤就不太可能發生。如果有重要的東西跑掉了,就修改原句並重跑一次;含糊的原文通常是罪魁禍首。
請它自我審查:「把這份譯文對照原文審查。標出誤譯、彆扭的措辭和語氣不符,並按段落標出你的信心程度。」模型是相當不錯的翻譯評審,尤其是讓第二個模型來審查第一個的輸出。
對於高風險的文字,在目標語言那一側加上一次人工查核。就算只有一位說母語的熟人讀一遍最終訊息,也能抓出任何自動查核都抓不到的文化失誤。用AI幫你走完95%的路程,並讓人工審查變快。
你該用哪個模型來翻譯?
沒有一個萬能的翻譯最佳模型,任何不先問你語言配對就直接點名一個的人,都是在用猜的。表現確實會因語言配對和文字類型而異:一個模型產出最自然的隨意德語,另一個更謹慎地處理日語敬語,再一個能在一份長合約裡把術語穩定地保持一致。
實用的答案,是就你自己的語言做一次十分鐘的測試。拿三段你實際會碰到的文字:一則隨意的訊息、一封正式郵件,以及一份文件裡密集的一段。把同一則翻譯提示詞在兩三個模型上跑一次,用一個不同的模型對每個結果做回譯,並記下哪一個需要的修正最少,而且對你能問到的任何母語者聽起來最自然。
跨ChatGPT、Claude和Gemini跑這個測試,通常需要三份訂閱,每份大約每月$20,沒有人會為了一次實驗去買。Whizi在一個方案之下把它們全部給你,內建並排比較,於是這個測試花的是十分鐘,而不是六十美元。測完之後,就用贏家繼續翻譯,並用第二名抽查重要的文字。
- 在每則翻譯提示詞裡說明讀者、關係和正式程度。
- 在模型翻譯之前,先列出必須保持不變的人名和術語。
- 要求提供關於含糊或經文化調整片語的備註。
- 保持文件結構一致,好讓你能並排比對。
- 對長文件或技術文件,先建立一份術語表。
- 在一段全新對話裡,用第二個模型回譯重要文字。
- 對具有法律效力的文件,使用宣誓的人工譯者。
- 在選定預設模型之前,就你具體的語言配對跨模型測試。
常見問題
ChatGPT翻譯得有Google翻譯那麼好嗎?
對主流語言的日常文字,ChatGPT、Claude和Gemini這類聊天模型通常翻譯得一樣好、甚至更好,因為它們會遵循關於語氣、讀者和術語的指令。傳統工具在路牌、菜單和網頁的即時抓大意翻譯上,仍然更快。
AI翻譯準確嗎?
對常見的語言配對和日常內容,準確性很高。品質會在稀有語言配對、大量俚語和專業術語上下滑。回譯查核能抓出大多數嚴重錯誤:用第二個模型把結果翻回你的語言,並比對意思和語氣。
AI能翻譯整份PDF或文件嗎?
可以。上傳檔案,說明它是哪一種文件,並要求譯文保留原本的結構。對於長檔案,先要一份關鍵術語表,並逐節翻譯以保持一致。
我能把AI翻譯用在官方文書上嗎?
通常不能。法院、簽證機構和大學一般要求由宣誓譯者出具經認證的翻譯。用AI來看懂官方文件、準備草稿,再請一位認證譯者出具要提交的版本。
翻譯最好用哪個AI模型?
這取決於語言配對和文字類型。可靠的選擇方式是做一個簡短測試:把同樣的三段文字跑遍兩三個模型,對結果做回譯,留下需要修正最少的那個模型。Whizi讓你在一個應用程式裡就能跑這個測試。