人工智慧與認知失調
原文由 Unattributed 于 發布,訂閱此部落格
位於伊利諾州林肯市的舊波斯特維爾法院,圖片來源:美國國會圖書館。亞伯拉罕·林肯曾於 1847 至 1859 年間在此執業。
出乎我意料的是,我那篇有點無聊的 Gravatar 小文章竟然被轉貼到了 Hacker News。這讓那篇文章獲得了不少關注,也引來了一些有趣的留言。其中最有趣的,是有人說我有「認知失調」:
我們活在一個充滿認知失調的世界。我們不得不如此,因為如果不這樣,你會發瘋。
這篇文章或許就是個好例子。一方面公開生活(發表部落格、在多個網站使用同一個頭像),另一方面卻又想控制這種公開性如何被消費(只限人類,不能給 AI)。
現在,不管你公開什麼,都已經進了 AI。不管是在 HN、你的部落格,還是其他任何地方。你可能不喜歡這樣,但公開終究就是公開。
諷刺的是,一篇因為某個服務用了「AI」這個行銷詞彙就決定離開的部落格文章,馬上就被加入了 AI 的訓練資料庫。
所以,我當然覺得有必要回應一下。
首先,在這個議題上我並沒有認知失調。相反地,我會說我對於人工智慧有一套相當細緻的原則。不過,我想你也不是來聽我長篇大論我對人工智慧的所有想法的。所以我簡單總結一下:人工智慧是一項充滿潛力的技術,但在目前這個階段,它還沒準備好面對大眾消費。儘管 Alphabet、OpenAI、Anthropic 以及其他公司讓你以為它已經成熟,實際上仍有大量工作與研究有待完成。而且,根據AAAI 發布的一份報告來看,人工智慧研究社群中相當大的一部分人也認同這個觀點。
接下來,談談「只要你公開的東西就會進入 AI」這個說法。
圍繞這個問題的爭議,屬於法律層面的討論。事實上,針對人工智慧公司(OpenAI、Meta、Alphabet 等)將大量受著作權保護的素材吸進系統的行為,目前有許多訴訟正在進行中。根據這個追蹤網站,目前已有 163 起案件。而且不只在美國,而是遍及全球。Anthropic 已經以 15 億美元和解了一起案件,這顯示有理由相信,這些公司其實清楚自己大量攝取他人作品、侵害所有權所造成的傷害。
這不是公開與私有的問題。這是所有權的問題。在美國以及許多其他國家,作品在創作完成的當下就自動歸創作者所有。公開分享作品並不會讓你喪失所有權。作品也不會在很長一段時間內自動進入公有領域,除非創作者明確將其釋出至公有領域。(而且,即使想這麼做也不容易。請參見Creative Commons 0 授權背後的說明。)
我對作品的所有權,意味著我有權控制作品如何被重製。舉例來說,我可以將重製權授權給出版社。也可以將這些權利轉讓給基金會或其他組織。我甚至可以在公開發表作品的同時,依然保有對作品的所有權。
像 Facebook、Twitter、Reddit 等社群媒體網站,情況可能就有所不同了。最初他們聲稱,重製你的貼文並不代表所有權轉移給他們。然而,隨著時間推移,他們越來越傾向於主張自己有權以他們認為合適的方式重製你的作品(最初大多是為了廣告,但如今這個界線已經越來越模糊)。
Alphabet 與 Reddit 簽有合約,大量吸取使用者的發文,而且他們肯定也在利用 Gmail、YouTube 以及所有能取得的來源來訓練他們的人工智慧。Meta 幾乎可以確定正利用 Facebook、Instagram 和 WhatsApp 來訓練旗下的人工智慧。而 Elon 旗下的公司則是想盡辦法在餵養 Grok。但我不必向這種所有權的喪失投降。我離開這些平台是有原因的。他們或許還留有我當年使用時殘留的資料,但我從未同意讓這些資料被拿去餵養人工智慧系統,我也不會心甘情願地再提供更多素材給他們。
希望這樣能釐清關於我在人工智慧議題上有所謂「認知失調」的誤解。
最後順帶一提:看到大家在旁邊討論我網站的美觀設計,我覺得很有趣。如前面所說,字型的確是 Work Sans。我也在間距上做了一些非常細微的調整,讓閱讀起來更舒服。網站的整體結構走的是極簡風格。透過這種極簡設計,我希望每個頁面都能保持輕量、快速載入(這方面有個問題,是受限於底層平台的運作方式)。頁尾沒有圖片,按鈕全都是用 HTML 做的。我使用的圖片都是經過手動編輯以縮小檔案大小(我的目標是每張圖片壓到 250K 以下)。至於顏色:我只是想要一種大地色系,不過對,棕褐色其實也不是我最喜歡的顏色。至於那位說不喜歡 logo 的朋友,我還能說什麼呢? :) 這個 logo 本來就帶點幽默意味——把「A」做成三角形,是想對「Unattributed」這個名稱做個小小的視覺暗示,這其實是在拿 Creative Commons 授權中的「姓名標示(Attribution)」條款開玩笑。(也就是「姓名標示:無名氏(Attribution: Unattributed)」)對——我知道這個笑點大多數人都 get 不到。
隨機一篇部落格
留言
登入後參與討論