
商傳媒|責任編輯/綜合外電報導
美國 AI 公司 Anthropic 昨日(1日)宣布,旗下對話式大型語言模型 Claude 導入一項創新的「AI 浮水印」技術,旨在協助辨識其生成內容。這項技術的推出,對於日益模糊的內容歸屬界線,以及人工智慧(AI)倫理議題,預計將帶來深遠影響。
這項 AI 浮水印技術的運作方式相當獨特,讓 Claude 在生成文字時,會『偏好』選擇特定顏色的詞彙——例如藍色或紅色。這些被標示顏色的詞彙對於人類而言是完全『隱形』且無法察覺的,但在 Anthropic 自家的掃描器眼中卻一覽無遺。
Anthropic 的研究顯示,當 Claude 生成一段較長的文字時,被標示為藍色的詞彙比例可能會高達八成。由於人類在寫作時,幾乎不可能以如此高的比例,頻繁選用這些特定顏色的詞彙,因此這種詞彙分佈模式,便成為判斷內容是否由 Claude 生成的重要線索。
這項技術的複雜性在於,浮水印並非簡單地固定使用某個詞彙,而是根據上下文情境,以一套複雜的公式來動態決定哪些詞彙應被『染色』。這使得移除浮水印變得極為困難,因為使用者根本不知道該尋找哪些特定詞彙來修改。據 Florida International University 報導,這些藍色詞彙在文本中看起來自然,但人類通常會使用許多同義詞來替換。
隨著人工智慧生成內容的能力不斷提升,如何區分內容是來自人類創作還是 AI 產物,已成為一項日益嚴峻的挑戰。這不僅關係到內容創作者的權益,也牽涉到資訊的真實性與信任度。Claude 的這項浮水印技術,或許能為解決部分問題提供思路,但同時也凸顯了 AI 時代內容真實性辨識的複雜性與倫理考量。

