Translating blog posts with GPT-4, or: on hope and fear

Salvatore Sanfilippo

用 GPT-4 翻譯部落格文章,或:論希望與恐懼

我平常寫部落格文章的流程大致分為兩個步驟:

  1. 花上數週或數月的時間思考我想說什麼。不,我並不是花好幾個星期專注在一篇部落格文章上,過程恰恰相反:我會為那些在我腦海中縈繞數週、對我至關重要的事物寫下部落格文章。
  2. 然後,一旦有足夠的想法以還算完整的樣貌匯聚在一起,我就會在 30 分鐘內寫完這篇部落格文章,通常不太在意形式,然後按下「發布」。這個過程通常是先寫下各個段落的標題,因為一開始我只有想表達內容的大致輪廓,接著再把空白的段落填上文字。

為什麼我會如此輕率地看待第二個步驟?因為我還有其他事情要做,如果寫部落格要花超過 30 至 60 分鐘,我寧願完全不寫,或是少寫一點,或是痛苦地去寫:這些都是我無論如何都想避免的事。寫部落格太重要了,不能放棄。對我而言,寧可犧牲形式。

同時,這也是為什麼我的許多部落格文章,無論內容或多或少有資訊量、或多或少有實用性,整體而言都寫得不好。我希望我在母語中還算能寫的這個事實,多少仍能在我的英文文章中看得出來,但我感覺到,我那極為有限的詞彙量、文法錯誤,以及時常直接從義大利文搬來轉成英文的句型結構,所有這些限制都無可挽回地損害了閱讀體驗。

這就是為什麼,為了寫那篇關於 LLMs(大型語言模型)和程式設計的部落格文章,我第一次嘗試了不同的方法:我先用義大利文寫好文章,再用 GPT-4 翻譯成英文。我相信,成果比平常的部落格文章好得多,而寫作所花的總時間與直接用英文寫作差不多,因為用義大利文寫稍微快一些,這剛好抵銷了把各個段落在 GPT-4 中剪下貼上、等待輸出、確認是否符合義大利文原意,以及在需要時進行一些修正與重寫所需的時間。

令我震驚的是,閱讀譯文時我竟能聽見自己的聲音。聽起來不像是別人寫的。而且有趣的是,那些偵測 GPT 生成文本的工具告訴我,這篇文章是「100% 由人類撰寫」。同時,這個過程看起來可能有點刻意:更糟的是,如果我繼續走這條路,我可能會對用英文寫作失去信心,所以我還不確定這個部落格未來會怎麼寫。有一件事是確定的:你現在讀到的這篇文章不只是由我自己寫的,而且按照這個部落格的傳統,除了快速瀏覽過一遍之外,甚至沒有重新閱讀或校正。如此一來,你可以看到我真正的英文寫作能力,如果你好奇的話,可以拿它跟那篇關於 LLMs 的文章比較。兩者之間的差距可說是無比巨大。

另一種觀點可能是,我真正的聲音存在於那篇翻譯後的部落格文章中,所以用英文寫作才是真正的虛飾。因為翻譯後的文章更能代表我在母語中的詞彙能力,而不是我在用英文寫作時所能展現的那種受限的能力。或許它捕捉到了更多我想表達的細微差別。但接著人們可以更深入地探討風格究竟是什麼。是比較關乎句型結構,以及你闡述想法的方式,還是更多關乎所使用的詞彙、為呈現特定意象與意義而精心挑選的字詞與形容詞?可能兩者皆是,而這兩件事本就是密不可分的一體。

無論如何,單單是在 2024 年的此刻,我終於有了這個選擇,就讓我充滿了希望與恐懼。對有了會說話的機器後,人類將擁有的可能性抱持希望。而恐懼則來自 AI 有可能讓每個人變得懶惰,不再願意去做像學習一門新語言這樣艱難的事。

原文由 Salvatore Sanfilippo 發布

本文章由 muse-spark-1.2-contributor 進行翻譯