哪些 API 會標記 AI 內容?16 款實測對照 10 項法規
目前已有 6 個司法管轄區與美國 4 個州,要求 AI 生成媒體在檔案內帶有機器可讀標記。我們透過 16 個 API SKU(各自計價的模型版本)生成圖片、影片與語音,直接檢查回傳的位元組:7 款帶有 C2PA manifest,4 款帶有中國的隱式標籤,沒有任何一款同時具備兩者,影片與音訊 SKU 則完全沒有標記。接著,我們用一般圖片處理流程轉換這些已標記檔案。無論使用哪一套圖片函式庫,所有 C2PA manifest 都在第一次重新編碼、縮放或裁切時消失。本文會實測缺口出在哪裡,以及補上這些缺口要付出多少成本。
TL;DR
- 11 款圖片 SKU 中有 7 款嵌入 C2PA(OpenAI、ByteDance);4 款嵌入中國的隱式標籤(Alibaba);同時具備兩者的數量為零。
- 影片 SKU 與全部 4 款語音 SKU 回傳的檔案都完全沒有標記,但歐盟與加州法規都涵蓋音訊與影片。
- OpenAI 的簽章可通過官方 C2PA 信任清單驗證;ByteDance 的簽章有效但不受信任,因為其憑證鏈結到的根憑證不在清單內。
- 所有 C2PA manifest 經過任何轉換後都沒有保留下來;中國標籤在 ImageMagick 的 PNG 對 PNG 處理中可以保留,在 Pillow 中不行,而且兩者只要轉換格式就會消失。
哪些法規真的要求檔案內含標記?
實際數量遠少於大量 AI 立法給人的印象。多數 AI 內容法規要求的是人眼可見的標籤,或是在合成媒體造成傷害時下架。只有下列法規直接規範檔案內的位元組,而這正是 API 使用者在生成時必須處理的要求。以下是針對引述條文所做的工程解讀,不是法律分析。法律面可先參考歐盟執委會的第 50 條指南與 IAPP 全球 AI 法規追蹤器。
| 法規制度 | 檔案必須包含的內容 | 生效日期 |
|---|---|---|
| 歐盟 AI 法案第 50(2) 條 | 以「機器可讀格式」標記;未指定技術,實務守則同樣採技術中立立場 | 2026-08-02 |
| 中國標識辦法+GB 45438-2025 | metadata 內須有包含指定欄位的隱式標籤(製作者代碼、內容 ID、簽章),另加可見標籤;這是唯一制定自有 schema 的制度,也是唯一已經開始執法的制度 | 2025-09-01 |
| 印度資訊科技規則 G.S.R. 120(E) | 可見標籤,以及「永久 metadata 或其他適當的技術來源追蹤機制……包括唯一識別碼」 | 2026-02-20 |
| 越南 AI 法第 11(2) 條 | 音訊、圖片與影片須「以機器可讀格式標記」;未定義技術 | 2026-03-01 |
| 哈薩克 AI 法第 21(2) 條 | 機器可讀標記;若內容模擬人物或事件,還須加上可見警告 | 2026-01-18 |
| 南韓 AI 基本法第 31 條 | 由營運者選擇人類可感知或機器可讀的標記;寬限期延續至 2027 年 | 2026-01-22 |
| 美國:加州,接著是康乃狄克州、猶他州、華盛頓州 | 檔案內須帶有「隱性揭露」:供應商、系統名稱與版本、時間與日期、唯一識別碼;加州另要求提供免費的公開偵測工具。適用於每月使用者超過 100 萬的供應商 | 2026-08-02 至 2027 年 |
其他地方只要求人眼可見的標籤,或完全沒有要求:美國超過 30 個州規定選舉 deepfake 必須附上聲明,但美國聯邦、英國、日本、澳洲與新加坡都沒有一般性的標記義務。(有兩個常見誤區:挪威目前尚未適用第 50 條,因為 AI 法案還未納入 EEA 協定;此外,儘管外界多有誤報,義大利 2025 年 AI 法並未規定標記義務。)
從工程角度可得出三個事實。各地制度的規格彼此不相容:歐盟未指定格式,中國制定自己的 schema,印度與越南則要求來源追蹤,卻沒有說明具體形式。多數西方供應商採用的 C2PA,幾乎沒有被具拘束力的法規直接指定:只有康乃狄克州與華盛頓州點名使用,沒有任何國家級制度指定 C2PA。此外,有 5 個立法機關把耐久性寫進義務中,要求來源資訊「難以竄改、移除或分離」(康乃狄克州)、「難以移除或竄改」(華盛頓州)、「永久 metadata」(印度)、「可顯示竄改痕跡」(猶他州的選舉廣告法),或「永久或無法輕易移除」(科羅拉多州)。下方的轉換測試,就是要衡量現有技術能否做到這些要求。
C2PA 標記在檔案裡實際是什麼?
它是一段加入檔案的已簽署 JSON,在圖片本身看不到。C2PA 由內容來源與真實性聯盟制定,在其技術規格中定義了「manifest」:記錄資產由誰建立、如何建立,並透過密碼學簽章偵測竄改。在 PNG 中,它會放在像素資料旁的獨立 chunk。逐一查看我們生成圖片中的 chunk,就能看到它位於何處、占用多少空間:
IHDR 13 bytes image header
caBX 21,767 bytes C2PA manifest store <- the mark
IDAT 2,115,575 bytes the actual pixels
IEND 0 bytes
在 2 MB 圖片中約占 22 KB,約為 1%,而且完全不會改動像素。圖片在任何檢視器中看起來都一樣;只有會主動尋找憑證的軟體,才會顯示「Content Credentials」徽章。
驗證程式從 OpenAI 圖片讀到的 manifest 如下,這裡只保留關鍵欄位:
{
"claim_generator_info": [{ "name": "OpenAI Media Service API" }],
"signature_info": {
"issuer": "OpenAI OpCo, LLC",
"time": "2026-08-22T13:47:29Z"
},
"assertions": [{
"label": "c2pa.actions.v2",
"data": { "actions": [{
"action": "c2pa.created",
"when": "2026-08-22T00:00:00Z",
"softwareAgent": { "name": "gpt-image", "version": "pre-2.0" },
"digitalSourceType": ".../digitalsourcetype/trainedAlgorithmicMedia"
}]}
}]
}
真正發揮作用的是三個部分。action 表示資產是新建立,而不是經過編輯;digitalSourceType: trainedAlgorithmicMedia 則是 IPTC 詞彙中代表「由生成式模型製作」的術語,也就是實際以機器可讀方式指出「AI」的欄位。software agent 指明模型。signature 則把所有資訊綁定到憑證,讓驗證程式判斷聲明是否被修改,以及由誰為它背書。
中國的隱式標籤由 GB 45438-2025 定義。這是隨標識辦法發布的強制性國家標準,不依賴任何簽章機構,直接使用純文字 JSON chunk 解決同一個問題:
{ "Label": "1",
"ContentProducer": "001191330106MA2CFLDG4R10001",
"ProduceID": "U-9TlH0PCIQomj9MzIc5VUuQ",
"ReservedCode1": "K-LBkc9peJ0Gox..." }
Label: 1 表示由 AI 生成,ContentProducer 是供應商登記的公司代碼,ProduceID 是供應商的內容編號,ReservedCode 則是簽章值。兩者目標相同,但信任模型不同:C2PA 由憑證機構為聲明背書;中國標籤則指向已登記公司,驗證工作交給需要檢查的人處理。
API 實際嵌入了什麼?
11 款圖片 SKU 中,7 款嵌入 C2PA,4 款嵌入中國標籤,而且不同供應商之間涇渭分明:
| SKU | 格式 | C2PA | 中國隱式標籤 | 建立時間戳記 |
|---|---|---|---|---|
| gpt-image-1、1-mini、1.5、2 | PNG | 有 | 無 | 僅日期,00:00:00Z |
| seedream-4.0、4.5、5.0 | JPEG | 有 | 無 | 精確到秒 |
| qwen-image-2.0、2.0-pro | PNG | 無 | 有 | 無 |
| wan2.7-image、2.7-pro | PNG | 無 | 有 | 無 |
| seedance-1.5-pro(影片) | MP4 | 無 | 無 | — |
| tts-1、qwen3-tts、google-tts-standard、chirp3-hd | MP3 / WAV | 無 | 無 | — |
兩組 C2PA 供應商都會寫入上述相同欄位,也就是 c2pa.created 與 trainedAlgorithmicMedia。兩家採用中國標籤的供應商也都輸出相同的 GB 45438 結構,只多了一組欄位,用來標示重新散布檔案的單位。相較於表格裡的有無,以下三點更值得注意。
這些簽章的信任程度不同。 驗證分成兩個步驟:先讀取 manifest,再確認簽署憑證能否串接到 C2PA 信任清單中的根憑證。一般驗證程式預設不信任任何憑證,因此所有檔案都會回報 signingCredential.untrusted,連有效檔案也不例外。要進行大規模驗證,第一步就是載入官方清單。載入後,OpenAI 圖片會回報受信任,因為其簽發 CA 是清單上的 17 個實體之一。ByteDance 則不是:其 manifest 透過 GlobalSign 的 S/MIME 中繼憑證簽署,這類憑證原本用於電子郵件,而其根憑證不在清單中。依規格用語,ByteDance 的 manifest 是「有效」的,也就是簽章驗證成功,圖片在簽署後未被修改;但它「不受信任」,所以符合規格的驗證程式不會為聲明者的身分背書。
OpenAI 的時間戳記沒有具體時間。 所有 OpenAI manifest 都寫成 2026-08-22T00:00:00Z,也就是生成日期當天午夜;ByteDance 則記錄到實際秒數。降低時間精度在隱私上有合理性,但加州的隱性揭露要求包含「時間與日期」,因此這一點值得交由法務確認。
音訊與影片都是空的。 歐盟 AI 法案與加州法規都涵蓋合成音訊和影片。這不是格式限制,因為 C2PA 規格支援以 MP4、WAV 與 MP3 作為載體。我們生成的 MP4 只有標準 QuickTime 容器欄位,沒有其他標記;4 個語音檔也只有 codec header。無論圖片以 base64 或 URL 回傳,標記內容都完全相同,因此交付路徑不會新增或移除來源資訊。
標記能撐過一般處理流程嗎?
C2PA manifest 全部無法保留;中國標籤只有在圖片工具會攜帶文字 chunk 時才留得下來。我們用 Python 的 Pillow 與 ImageMagick 各跑一次相同的 5 種操作,測試 3 個已標記檔案:一張 OpenAI C2PA 圖片、一張 ByteDance C2PA 圖片,以及一張 Alibaba 中國標籤圖片,因此看出了這項差異。
| 轉換 | C2PA(OpenAI) | C2PA(ByteDance) | 中國標籤(Alibaba) |
|---|---|---|---|
| 位元組複製 | 保留 | 保留 | 保留 |
| 重新編碼為 PNG | 消失 | 消失 | 視工具而定 |
| 縮放至 50% | 消失 | 消失 | 視工具而定 |
| 裁切 10% | 消失 | 消失 | 視工具而定 |
| 轉換為 JPEG q90 | 消失 | 消失 | 消失 |
| 轉換為 WebP q85 | 消失 | 消失 | 消失 |
Pillow 在每一種操作中都遺失所有標記,15 次中成功 0 次。ImageMagick 則在 15 次中保留 3 次,全部都是中國標籤在 PNG 對 PNG 操作中留存。關鍵不在圖片品質:重新編碼為無損 PNG,破壞 C2PA manifest 的效果和有損 JPEG 完全一樣。
原因很直接。中國標籤是一般的 PNG 文字 chunk(tEXt,標準的鍵值字串欄位),所以會複製文字 chunk 的工具不必額外處理就能保留。ImageMagick 預設會複製,Pillow 則需要明確指定。C2PA manifest 位於主流圖片工具不認識的自訂 chunk,因此不論是否要求保留 metadata,工具都會丟棄。ImageMagick 在一般縮放時會捨棄它;即使傳入明確要求包含所有 chunk 的旗標,結果仍然相同。只要跨越格式邊界,兩種標記都會消失,因為 PNG 文字 chunk 在 JPEG 或 WebP 中沒有對應位置。
因此,實務規則比「metadata 很脆弱」更具體。如果必須轉換,請留在同一種格式內,並選用會保留文字 chunk 的函式庫,中國標籤就能跟著留下來。一般工具沒有保留 C2PA 的方法:受支援的做法是在轉換後重新簽署。這雖然可行,但會改變聲明內容,因為新的 manifest 會把你的處理流程列為簽署者,而非模型供應商;在你的憑證加入信任清單前,它也會顯示為不受信任。
再對照前述 5 種法規用語:縮圖程式、CDN 轉換、移除 EXIF 的隱私處理,甚至使用者截圖,都會抹除這些標記。因此,法規所指向的技術本身,無法達到它們要求的耐久性。能撐過這些處理的是寫入像素的不可感知浮水印。部署最廣泛的是 Google SynthID,但它沒有公開偵測器,檢查入口也只有候補名單,因此第三方無法確認檔案是否帶有浮水印。能直接從檔案驗證的只有 metadata 層;在兩套函式庫與三種標記的測試中,只有一種組合能撐過轉換:ImageMagick 搭配中國標籤。
反正標記會消失,還值得提供嗎?
值得,因為真正重要的平台會在標記仍然存在的唯一時刻讀取它:上傳時。即使 manifest 撐不過你的縮圖程式,只要你交付的是原始檔案,平台仍會先讀取;而平台加到貼文上的標籤,會比 metadata 存活得更久。
| 平台 | 上傳時讀取什麼 | 後續處理 |
|---|---|---|
| TikTok | 自 2024 年 5 月起讀取 C2PA Content Credentials | 自動標記由外部製作的 AI 內容;也會為 TikTok 內容附上自己的憑證,這些憑證「在內容下載後仍會保留」 |
| YouTube | C2PA metadata,加上創作者自行聲明 | 自動標記「含有 C2PA metadata 的內容」;創作者若持續未揭露,可能被強制加上標籤、移除內容,或遭停權退出合作夥伴計畫 |
| Meta | C2PA 與 IPTC 指標,加上分類器與自行揭露 | 加上「AI info」標籤 |
| 僅讀取 C2PA manifest,沒有自有偵測器 | 顯示 Content Credentials 徽章 | |
| X | 其真實性政策中未記載會讀取來源資訊 | 依分類器與檢舉執法 |
這會改變工程上的結論。metadata 層不是檔案的持久屬性,而是只要對方收到原始位元組,你就有一次機會送出的訊號。提供它之後,TikTok 與 YouTube 會把訊號轉成儲存在平台資料庫,而不是 PNG 內的標籤。若不提供,就只能仰賴平台分類器猜測。這裡有兩項限制:這些平台都沒有說明重新提供給使用者的檔案是否仍帶有 manifest,我們也沒有測試;X 則完全沒有記載任何來源資訊讀取機制。
收到未標記的檔案時該怎麼辦?
自行加上標記。真正要決定的是能加哪一層,以及在哪裡加。我們實測了 metadata 路徑:使用自己的 C2PA manifest 簽署一張未標記的 Alibaba 圖片,耗時 59 ms,檔案增加約 8%,從 1.18 MB 增至 1.28 MB。新的 manifest 以 trainedAlgorithmicMedia 宣告 c2pa.created,標示上游模型,並能與檔案中原有的中國標籤共存。換句話說,檔案可以同時帶有兩套系統,只是沒有任何供應商會同時提供。這裡也有兩個問題:自行簽署的 manifest 會和 ByteDance 一樣回報不受信任;重新編碼後,新標記也會和供應商標記一樣立即消失。
| 補救方式 | 解決的問題 | 成本 | 脆弱性 |
|---|---|---|---|
| 生成後離線簽署 C2PA manifest | 歐盟的機器可讀標記;若填入供應商、版本、時間與識別碼,也可符合加州的隱性揭露 | 59 ms、檔案增加 8%,另需由認可簽發者提供憑證 | 任何重新編碼都會使其消失 |
| 在交付時由 API 路徑注入 manifest | 與上方相同,但可統一套用 | 相同操作,只是提前執行 | 相同 |
| 將可見標籤直接寫入像素 | 加州的畫面揭露選項(法規稱為「manifest」揭露,與 C2PA manifest 無關)、中國的顯式標籤 | 一次合成處理 | 可撐過所有處理,但會改動圖片 |
| 以內容雜湊為索引保存生成紀錄 | 遵循法規的證據、中國的 6 個月保存義務 | 儲存成本,無逐檔處理 | 不依賴檔案 |
| 不可感知浮水印 | 能撐過轉換的標記層 | 有開源 encoder,但沒有可互通標準,因此其他人無法驗證你的浮水印 | — |
離線簽署與在 API 路徑簽署,對相同位元組執行的是同一個操作;差別在於簽章指向誰。若在閘道簽署,就是由閘道為檔案來源背書;若在應用程式內簽署,背書者就是你,並由你管理自己的憑證與金鑰。若你的義務是揭露產品使用 AI 生成內容,聲明就應該由承擔這項義務的一方發出。
有一項控制措施完全不必修改檔案,卻最常被團隊忽略:生成紀錄。中國要求未提供可見標籤的供應商保存內容接收者紀錄至少 6 個月,而所有 API 都屬於這種情況。檔案經過處理流程並遺失 metadata 後,也只能靠紀錄證明當時有遵循規範。如果你已記錄 request ID、模型與時間戳記,通常缺少的是交付位元組的雜湊。補上後,才能把紀錄對應回已經失去 metadata 的檔案。
常見問題
中國圖片模型會標記輸出嗎?
會,但不是 C2PA。Alibaba 的 qwen-image 與 wan2.7 SKU 會嵌入 GB 45438-2025 定義的隱式標籤:一個 metadata 欄位,包含製作者登記的公司代碼、內容 ID 與簽章值。ByteDance 的 seedream SKU 則相反,只嵌入 C2PA,不含中國標籤。在 11 款圖片 SKU 中,沒有任何一款同時嵌入兩者。
如果處理流程會縮放圖片,C2PA 標記還能保留嗎?
不能。使用主流圖片工具時,Pillow 或 ImageMagick 的縮放操作都會移除 C2PA manifest。manifest 位於自訂 chunk 中,即使要求保留所有 chunk,Pillow 與 ImageMagick 仍會將其捨棄。唯一受支援的方式是重新簽署轉換後的檔案,但這會使你的處理流程成為簽署者。中國標籤是一般 PNG 文字 chunk,ImageMagick 預設會保留,Pillow 則需要明確複製;轉換為 JPEG 或 WebP 時,兩者都會遺失。
API 輸出沒有標記,會造成我的合規問題嗎?
未標記檔案是否由你負責,取決於你在適用制度下屬於供應商還是部署者,這需要交由法務判斷。實測能確定的是事實面:若你透過這些 API 生成語音或影片,或使用 Alibaba SKU 為歐盟受眾生成圖片,檔案內不會帶有歐洲驗證程式可識別的內容,標記必須由你自行加入。
測量日期為 2026-08-22,經由 Synthorai 閘道執行:11 款圖片 SKU 各生成兩次,並分別以 base64 與 URL 交付;另測試 1 款影片 SKU 與 4 款文字轉語音 SKU。每個檔案都檢查 C2PA manifest、IPTC 與 XMP 欄位,以及 GB 45438 標籤 chunk。驗證 C2PA 簽章時,已載入官方信任清單,並另以公開 Content Credentials 驗證器使用的過渡清單驗證。留存測試使用 Pillow 與 ImageMagick,針對每個標記家族各取一個檔案,執行 5 種操作(重新編碼為 PNG、縮放、裁切、轉換為 JPEG 與 WebP),並納入各函式庫的 metadata 保留選項。補救措施數據來自使用自有 manifest 簽署一張未標記圖片,並在轉換前後重新檢查。法規表格是針對引述條文的工程解讀,不是法律意見;供應商可能不經通知就改變標記行為,因此在依賴任何一列資料前,請重新測量。
同系列文章:圖片生成成本、Qwen-Image 3.0 實測、影片生成定價、語音代理成本。