標記只能說明一件事
OpenAI明確區分了浮水印能做什麼、不能做什麼。標記只能說明,OpenAI的系統生成或處理過部分文字。它無法說明誰使用了該系統、人做了多少貢獻、文章屬於誰,或內容是否正確[1]。Anthropic也表示,浮水印不包含個別使用者的資訊[2]。
| 要問的問題 | 浮水印給出的答案 |
|---|---|
| AI系統是否生成或處理過部分文字 | 偵測到標記,就說明是 |
| 誰使用了該系統 | 無法說明 |
| 人做了多少貢獻 | 無法說明 |
| 文章屬於誰 | 無法說明 |
| 內容是否正確 | 無法說明 |
| 未偵測到標記,是否說明是人寫的 | 不能作為人寫的證據 |
目前哪些文字會加上標記
OpenAI於2026年10月5日宣布,將在接下來的數週內,為ChatGPT和Codex於歐盟生成的適用文字加入不可見浮水印。自同一天起,全球API客戶也可以在部分模型上自行啟用這項功能。不過,API中的預設值是關閉,推出時也不會在全球預設啟用[1]。
在此之前,Anthropic已於8月14日宣布,將在後續推出的Claude模型生成的文字中加入浮水印。由於沒有可靠的方法依地區區分實施,因此從一開始就會在全球套用[2]。這表示,在韓國用Claude起草工作文件的人,從新模型開始也會納入適用範圍。
OpenAI採用的方法是textGrain。它在詞語選擇中加入統計訊號,留下人眼看不見、但偵測器能透過統計辨識的模式[1]。Anthropic則以Google DeepMind於2024年在學術期刊《Nature》上發表的SynthID-Text方法為基礎[2]。
僅憑偵測結果,量不出改了多少
從AI Matters報導的數據來看,浮水印偵測率會隨文字長度和修改程度而變化。將誤報率設為1%時,長度為400 token的文字約有95%被偵測出,200 token的文字約有80%被偵測出。在400 token的文字中,將10%的詞語替換為同義詞後,偵測率從約92%降至66%;替換25%後,則降至17%。數學文本的偵測率要低得多[3][4]。
Anthropic的說明也指向同樣的結論。該公司表示,輕度修改不會讓標記完全消失,但如果重寫時換掉所有詞語,標記就會消失[2]。
因此,不能把偵測結果的高低當作自己的貢獻程度。僅把部分詞語換成同義詞,偵測率就會下降,但這並不表示文章中融入了更多自己的判斷。OpenAI也明確表示,僅憑標記無法得知人做了多少貢獻[1]。
偵測器也並非人人都能使用。OpenAI初期只向獲准的研究人員和專業機構開放偵測器[1]。Anthropic的偵測API仍處於非公開預覽階段,對象為歐盟法律規定的機構與群體(監管機關、執法機關、媒體、事實查核人員、獨立研究人員、教育機構、歐盟公民團體),以及為遵守法規而負有查核義務的企業[2]。目前還不是團隊主管或公司審查人員提交文件後,就能立即取得判定的階段。
用稿件版本紀錄和筆記留下自己的工作
以AI初稿為基礎撰寫文件的人,若想呈現自己所做的貢獻,就需要標記以外的紀錄。呈現修改過程的稿件版本紀錄、參考資料清單,以及記錄工具使用階段的筆記,都可以發揮這個作用。
筆記中應包含的項目,與書稿的紀錄並沒有太大差別。「寫稿時用了AI,該告訴出版社哪些事」這篇指南提出的四欄(工具、使用階段、使用範圍,以及人工查核的內容),也可以直接用於工作文件。如果提問的是團隊主管或客戶,而不是出版社,同樣可以用這份紀錄回答。
對於工作文件,做好三件事即可。
- 將AI提供的初稿按收到時的原樣另外儲存。沒有最初的版本,就無法比較改了什麼。
- 每次大幅修改時,都另存一個版本。在名稱中註明做了什麼,例如調整結構的版本、查核數據的版本。
- 在文件末尾或另外的筆記中,記錄參考資料和使用工具的階段。
法律將標記義務交給了誰
歐盟《人工智慧法》第50條規定的透明度義務,自2026年8月2日起適用。利用AI生成文字的系統提供者,必須在輸出內容中加入機器可讀的標記,使其能夠被偵測。協助一般編輯的輔助功能,或未對輸入作出實質改動的情況,屬於例外。8月2日之前已投放市場的生成式AI系統,可獲得截至2026年12月的寬限期[5]。
發布文字的一方也有義務。如果為了向大眾介紹公共關注事項,而發布未經人工審查或編輯責任把關的AI生成文字,就必須加上使用者能夠辨識的標示。相反地,經過人工審查並由人承擔責任的文字,可免於這項標示義務[5]。
標記也無法呈現你承擔了審查和編輯工作。這份紀錄同樣需要由人留下。
韓國的人工智慧基本法於2026年1月22日施行。對於並非深度偽造的AI生成內容,可以使用不可見浮水印取代可見標示。政府決定,自施行日起設置至少一年的宣導期,在此期間暫緩事實調查和裁處罰鍰[6]。
參考資料
- [1] OpenAI開發者社群,OpenAI's approach to EU text provenance rules,2026年10月5日。
- [2] Anthropic,How Claude's text watermarking works,2026年8月14日。
- [3] AI Matters,2026年10月6日報導。
- [4] TechCrunch,2026年10月5日報導。
- [5] 歐盟執委會,Quick Facts: Transparency rules for AI systems。
- [6] 科學技術資訊通信部,人工智慧基本法新聞稿。
常見問題
未偵測到浮水印,能證明文章是我寫的嗎?
不能。OpenAI明確表示,未偵測到浮水印,並不能證明文字是人寫的。可能使用了其他公司的模型,也可能是在修改過程中,訊號變弱了。要證明自己寫了什麼,需要保留各版本稿件和筆記。
浮水印中會包含我的姓名或帳號資訊嗎?
Anthropic表示,浮水印中不包含能夠辨識使用者身分的資訊。OpenAI也說明,僅憑標記無法得知誰使用了該系統。標記所能說明的,僅限於AI系統是否生成或處理過部分文字。