Claude 將在文本中加入不可見的水印:能提示模型參與,但不能代替人類判定作者
CoinMeta
09-02 11:26
Ai 焦點
Anthropic 在9月1日宣布,未來的 Claude 模型將逐步為生成的文本加入不可見的水印,并向符合條件的機構開放檢測接口的私人測試。這並不是在句子中塞入肉眼看不到的字符,也不是給每篇文章附上一串用戶編號,而是通過在多個同樣合理的詞語之間輕微調整選擇概率,讓較長的文本呈現出可被統計識別的模式。
有幫助
No.幫助

Anthropic 在9月1日宣布,未來的 Claude 模型將逐步為生成的文本加入不可見的水印,並向符合條件的機構開放檢測接口的私人測試。這並不是在句子中塞入肉眼看不到的字符,也不是給每篇文章附上一串用戶編號,而是通過在多個同樣合理的詞語之間輕微調整選擇概率,讓較長的文本呈現出可被統計識別的模式。

該公司採用了 SynthID-Text 的一種實現方式,稱該機制不會增加 Token 的輸出,在內部評估中也未發現可操作的品質下降。水印將在全球新模型上啟用,舊模型將有過渡期,整體推出不預計會持續數月。Anthropic 明確承認,目前沒有可靠的方法可以按地區長期隔離這種機制,因此選擇統一部署,而不是只在歐盟提供。

這項安排與歐盟的《人工智能法》及其通用人工智能模型實踐準則有關。Anthropic在2026年7月簽署了該準則,相關的透明性要求於8月2日開始適用。不過,將合規行為理解為「AI文本之後都能驗明正身」會嚴重誇大其效果。官方對水印的定位非常謹慎:檢測結果只能說明Claude可能參與了文本的生成,但不能證明文本究竟是由人還是AI完成的,更無法識別具體的用戶、組織或對話。

水印改變的是詞語的概率,而不是給每篇文章蓋上唯一的身份章

大模型在生成一句话時,通常會有多個意義相近、語法正確的下一個詞的候選。水印系統使用一個秘密規則,對這些候選的抽取概率進行微小的偏移。單個詞看不出異常,但在足夠長的文本中,這些偏移會累積成統計信號。檢測器根據這個信號來估計文本是否與 Claude 的水印分佈相符,而不是在文件中尋找一個固定的標記。

這種設計有兩個直接的好處。第一,即使複製到純文本中、更改字體或截去檔案元數資料之後,訊息仍有可能被保留;第二,它不會像零寬字元那樣被簡單的格式清理立即刪除。同時,它的證據性質也較弱:統計相關並不等於身份證明。兩個人獨立寫出的短句可能相似,多個模型和人工編輯也可能共同完成一篇文章,檢測器只能給出概率判斷。

Anthropic 列出了多项限制。短文本沒有足夠樣本,檢測效果會下降;事實性很強的段落可選擇措辭較少,信號空間有限;代碼需要精確輸出,不適合自由改變詞語;只進行輕微編輯可能會保留水印,大幅改寫、翻譯或讓另一個模型重述,則可能會把信號洗掉。因此它更適合調查來源不明的長篇材料,不能作為考試作弊或新聞造假的單一裁決工具。

水印也不會編碼個人信息。Anthropic 表示,這種機制不能指向某個賬戶、企業或聊天記錄。這一限制降低了水印成為跨文本追蹤器的風險,但同時也意味著平台無法僅憑檢測結果來回答「是誰生成的」。如果機構需要審計具體的工作流程,仍需依賴於賬戶日誌、版本記錄、引用鏈和人工聲明,不能將責任追蹤外包給一個數值。

檢測接口先提供給專業機構,真正的難題在於如何避免將概率當作判決。

首批私測對象包括符合條件的監管機構、媒體與事實核查組織、研究人員、教育機構、歐盟民間社會組織,以及承擔相關義務的企業。Anthropic 計劃逐步擴大範圍,而不是立即提供一個人人可用的公開檢測網頁。這樣做有現實原因:如果攻擊者可以無限次試驗文本並即時得到結果,就更容易反向尋找去除水印的方法;專業用戶也更有條件理解誤報和漏報。

生成文件還會有另一層標記。對於受支持的檔案類型,Claude 將使用 C2PA 內容憑證來保存來源元資料。C2PA 與文本水印解決的是不同問題:前者更像是隨檔案攜帶的可驗證履歷,適合未被剝離元資料的原始檔案;後者則嵌入在語言分佈中,更能承受複製貼粘,但結論更偏向於概率化。兩者疊加仍然無法覆蓋截圖、重寫和跨模型加工的所有情況。

學校、編輯部門和平台最容易犯的錯誤,就是將檢測閾值直接設定為處罰閾值。水印檢測應該觸發進一步的核實,例如查看寫作過程、草稿和引用等,而不應該單獨決定學生是否作弊、作者是否造假。機構還需要保存模型版本和檢測器版本,因為算法升級後,同一段文本的評分標準可能會發生變化。在對外發布結論時,也應該說明樣本長度、編輯歷史和不確定性,而不是只展示一個百分比。

水印的价值不在于製造一臺「AI 誊言測試儀」,而在于為來源調查增加一條機器可讀的線索。當越來越多內容經過模型輔助之後,二進制問題「是否是 AI 寫的」本身就會失去意義,更有用的是 AI 參與了哪些環節、最終責任由誰承擔、證據鏈是否完整。Anthropic 這次提供的是一項有限但可部署的技術措施;只有配合日誌、內容憑證和人類的程序正義,它才有可能提升透明度,而不是製造新的誤判。

打賞
$0
點讚
0
收藏
0
瀏覽量 70
HKWDB提醒,請廣大讀者理性看待區塊鏈,切實提高風險意識,警惕各類虛擬代幣發行與炒作,站內所有內容僅係市場資訊或相關方觀點,不構成任何形式的投資建議。如發現站內內容含敏感資訊,可點擊“舉報”,我們會及時處理。
提交
評論 0
最熱
最新
還沒有人評論喔~快搶沙發吧!
相關閱讀
web3:沃勒稱9月是否加息仍需看8月通脹數據
美聯儲理事沃勒稱,9月是否加息取決於8月的通脹表現,市場隨即下調加息預期。
Coinpaper
·2026-09-04 02:47:53
12
美股高開走強,9月季節性風險仍受關注
美股周四上涨,受美債收益率回落帶動,但油價、就業數據與9月歷史弱勢仍是市場關注點。
Coinpaper
·2026-09-04 02:47:50
14
以太坊:比特币現貨 ETF 轉為淨流入,ETH 與 XRP 结束連漲
美國現貨加密 ETF 資金流週三分化:比特幣恢復淨流入,以太坊和 XRP 结束連續吸金。
Coinpaper
·2026-09-04 02:47:44
10
Meta 下调 Muse Spark 价格以換取用戶數據
Meta為Muse Spark推出低價換數據方案,試圖通過折扣獲得真實使用記錄,以改善AI智能體模型。
TechCrunch
·2026-09-04 02:34:57
15
OpenAI 新模型 Astra 架构調整引發安全爭議
OpenAI 新模型 Astra 据稱採用更高效的架構,部分安全研究人員擔心這會削弱對 AI 推理過程的監測能力。
Fortune
·2026-09-04 02:34:54
10
查看更多