Trao đổi về dự án
Dữ liệu và tuân thủ

Đóng dấu văn bản, C2PA và Credentio: xây dựng chuỗi nguồn gốc cho nội dung AI

Một watermark thống kê, một chữ ký C2PA và một sổ đăng ký sản xuất không giải quyết cùng một vấn đề. Sự kết hợp của chúng cho phép xác thực nguồn gốc mạnh mẽ hơn của các nội dung được tạo ra.

Đóng dấu văn bản, C2PA và Credentio: xây dựng chuỗi nguồn gốc cho nội dung AI

Hai thông báo gần nhau đã làm sống lại chủ đề về nguồn gốc của nội dung do AI tạo ra: Anthropic đã trình bày vào ngày 14 tháng 8 năm 2026 một watermark thống kê cho các mô hình Claude trong tương lai, trong khi Google đã mở Credentio, một thư viện xác thực C2PA. Những công nghệ này mang tính bổ sung, nhưng không cái nào tự chứng minh rằng một nội dung là thật, hợp pháp hoặc hoàn toàn do con người tạo ra.

1. Ba vấn đề thường bị nhầm lẫn

Phát hiện nhằm ước lượng xem liệu một nội dung có khả năng đã được tạo ra bởi một mô hình hay không. Nguồn gốc mô tả lịch sử được khai báo của một tệp: công cụ, các biến đổi, chữ ký và danh tính của người phát hành. Tính xác thực nhằm xác định rằng nội dung thực sự tương ứng với một nguồn hoặc một sự kiện thực tế.

Những khái niệm này không thể thay thế cho nhau. Một tệp C2PA được ký đúng cách có thể chứa thông tin sai do một tổ chức được xác thực công bố. Một chữ ký kỹ thuật số (watermark) có thể cho thấy một mô hình có khả năng đã tham gia vào một văn bản mà không xác định tác giả hay chủ sở hữu. Cuối cùng, một nội dung do con người tạo ra có thể mất tất cả siêu dữ liệu khi sao chép.

Một chính sách nghiêm túc do đó phải trả lời riêng rẽ ba câu hỏi: ai đã sản xuất hoặc biến đổi nội dung, những bằng chứng kỹ thuật nào đi kèm tuyên bố này và ai đã xác nhận việc xuất bản?

2. Cách thức hoạt động của một watermark văn bản

Anthropic thông báo rằng một thế hệ tương lai của các mô hình Claude sẽ sử dụng một phiên bản của phương pháp SynthID-Text. Hệ thống này không dựa trên các ký tự ẩn cũng không thêm một token có thể nhận dạng. Nó thay đổi nhẹ xác suất của một số lựa chọn từ khi nhiều cách diễn đạt có ý nghĩa tương đương.

Trên một văn bản đủ dài, một bộ phát hiện có thể tìm kiếm sự phân bố thống kê này và ước tính xem Claude có khả năng đã tham gia vào việc tạo ra hay không. Anthropic lưu ý rằng việc đánh dấu không cho phép xác định một người dùng hoặc tổ chức cụ thể.

Mục đích là không làm thay đổi rõ ràng nội dung hoặc định dạng của nó. Cơ chế có thể theo dõi văn bản sau khi sao chép-dán, trái ngược với một siêu dữ liệu tệp đơn giản.

3. Những giới hạn được công nhận của việc đánh dấu thống kê

Chữ ký số ít đáng tin cậy hơn trên các văn bản ngắn, mã, các câu trả lời mang tính thực tế cao hoặc nội dung bị hạn chế nhiều. Trong những tình huống này, mô hình có ít lựa chọn về phong cách hơn mà không làm giảm chất lượng.

Một việc viết lại hoàn toàn cũng có thể loại bỏ tín hiệu. Do đó, bộ phát hiện được thông báo phải cung cấp xác suất, không phải phán quyết pháp lý. Kết quả âm tính không chứng minh rằng không có AI nào đã được sử dụng, và kết quả dương tính cũng không chứng minh quyền sở hữu hay ý định.

Kể từ bản cập nhật ngày 1 tháng 9 năm 2026, Anthropic cung cấp API phát hiện ở phiên bản thử nghiệm riêng cho một số tổ chức đủ điều kiện và các doanh nghiệp phải chịu các nghĩa vụ tương tự. Chưa có quyền truy cập công khai nào được công bố. Các doanh nghiệp không nên xây dựng quyết định tự động có tác động lớn chỉ dựa trên tín hiệu này, ngay cả khi họ có quyền truy cập phiên bản thử nghiệm.

4. Những gì C2PA mang lại cho các tệp

C2PA định nghĩa các Content Credentials, tức là các bản khai nguồn gốc liên kết mật mã với một tập tin. Chúng có thể ghi lại danh tính của người ký, công cụ sử dụng và một số biến đổi. Việc xác thực cho phép kiểm tra rằng bản khai và tập tin không bị thay đổi kể từ khi ký.

Cách tiếp cận này đặc biệt phù hợp với hình ảnh, video, tài liệu và các tài sản khác được xuất bản dưới dạng tập tin. Nó tạo điều kiện cho một chuỗi trách nhiệm: tạo, chỉnh sửa, xuất và phát tán.

Tuy nhiên, C2PA không đảm bảo sự thật của cảnh quay cũng như chất lượng của người phát. Sự tin cậy phụ thuộc vào danh sách các cơ quan hoặc tổ chức được công nhận, việc bảo vệ các khóa và khả năng của giao diện trong việc giải thích thông tin cho công chúng.

5. Vai trò của Credentio

Google đã phát hành Credentio, một thư viện C++ mã nguồn mở nhằm xác thực các Content Credentials tuân thủ các phiên bản 2.2 và 2.4 của các đặc tả C2PA. Công ty cho biết cùng nền tảng này đã được sử dụng trong nhiều sản phẩm và trên một khối lượng rất lớn các tài sản.

Thư viện được thiết kế để hoạt động cục bộ: một tệp không cần được gửi đến dịch vụ bên ngoài để xác thực. Điều này giảm độ trễ, tiêu thụ băng thông và việc tiết lộ nội dung nhạy cảm.

Credentio cho phép cấu hình các danh sách tin cậy chính thức hoặc riêng tư và tạo ra các báo cáo chi tiết về khai báo, khẳng định, chữ ký và tuyên bố. Phiên bản đầu tiên tập trung vào việc xác thực. Việc tạo và tích hợp các Chứng nhận Nội dung mới được thông báo sẽ có sau.

Tuy nhiên, kho lưu trữ lưu ý rằng dự án vẫn đang trong quá trình phát triển tích cực, có thể đưa ra các thay đổi phá vỡ mà không báo trước, không tự cung cấp các danh sách tin cậy và không phải là một sản phẩm được Google hỗ trợ chính thức. Do đó, một tích hợp trong môi trường sản xuất cần cố định một phiên bản, quản lý danh sách tin cậy của riêng mình và dự kiến các bản cập nhật.

Đối với một doanh nghiệp, lợi ích chính là có thể tích hợp việc xác minh vào một DAM, một CMS, một chuỗi kiểm duyệt hoặc một ứng dụng di động mà không phụ thuộc vào một endpoint sở hữu riêng.

6. Mối liên hệ với Đạo luật AI

Các nghĩa vụ minh bạch theo Điều 50 của Đạo luật AI có hiệu lực từ ngày 2 tháng 8 năm 2026. Chúng quy định cụ thể rằng một số nội dung được tạo ra hoặc thao tác bởi AI phải được đánh dấu ở định dạng có thể đọc được bằng máy và có thể phát hiện được, tùy thuộc vào các ngoại lệ và phương thức được quy định. Một điều khoản chuyển tiếp cho phép đến ngày 2 tháng 12 năm 2026 để một số hệ thống đã được đưa ra thị trường trước ngày 2 tháng 8 tuân thủ.

Ủy ban châu Âu đã công bố các hướng dẫn và bộ quy tắc thực hành tốt cuối cùng về nội dung do AI tạo ra trước khi có hiệu lực. Các tiêu chuẩn kỹ thuật như C2PA hoặc chữ ký kỹ thuật số có thể góp phần vào việc triển khai, nhưng sự hiện diện của chúng không đủ để chứng minh toàn bộ sự tuân thủ.

Cần liên kết việc đánh dấu với trường hợp sử dụng, với thông tin cho người dùng, với sổ đăng ký hệ thống và với trách nhiệm biên tập. Chúng tôi kế hoạch hành động Đạo luật AI cung cấp khuôn khổ chung.

7. Một kiến trúc có nguồn gốc thực tế

Lớp đầu tiên là nhật ký sản xuất. Mỗi tài sản nhận một mã định danh, một tác giả hoặc bộ phận, mô hình và phiên bản được sử dụng, các nguồn, các biến đổi và người kiểm duyệt con người.

Lớp thứ hai là đánh dấu phù hợp với nền tảng. Đối với một tệp, một Chứng chỉ Nội dung có thể được ký khi xuất. Đối với một văn bản, một watermark có thể là một tín hiệu bổ sung khi nó có sẵn.

Lớp thứ ba là việc xuất bản. Hệ thống quản lý nội dung (CMS) duy trì liên kết giữa tài sản, bảng khai của nó, giấy phép của nó và quy trình phê duyệt. Một giao diện có thể truy cập được cho phép người đọc tham khảo nguồn gốc mà không buộc họ phải giải thích một báo cáo mật mã thô.

Lớp thứ tư là khả năng phục hồi. Hệ thống phải quản lý việc mất dữ liệu siêu, chuyển đổi định dạng, chụp màn hình và thu hồi khóa. Nội dung được xuất bản vẫn phải có thể truy xuất trong sổ đăng ký nội bộ ngay cả khi tín hiệu công khai đã biến mất.

Trois colonnes comparant les forces et limites du watermark probabiliste, de C2PA cryptographique et du registre avec workflow métier.
Phát hiện, bằng chứng mật mã và quản trị nghiệp vụ bổ sung cho nhau; không có lớp nào tự nó bao phủ toàn bộ nguồn gốc.

8. Kế hoạch triển khai cho một doanh nghiệp

Bắt đầu bằng cách lập danh mục các nội dung liên quan: bài viết, hình ảnh, video, tài liệu thương mại và phản hồi tự động. Phân loại rủi ro theo tác động của việc gán nhầm hoặc thao túng.

Sau đó hãy xác lập một chính sách: ai có thể tạo ra, ai xác nhận, nhãn nào được áp dụng, bằng chứng được lưu giữ bao lâu và cách sửa lỗi. Tách biệt các bằng chứng kỹ thuật với các tuyên bố biên tập.

Thử nghiệm C2PA trên một luồng hạn chế, ví dụ như các hình ảnh blog được tạo ra hoặc chỉnh sửa bằng AI. Kiểm tra chữ ký sau khi nén, qua CDN và tải xuống. Đối với văn bản, chỉ đánh giá phiên bản riêng tư của bộ phát hiện nếu tổ chức của bạn đủ điều kiện, không sử dụng nó như một kiểm soát tự động có tác động lớn, và giữ mô hình cùng quy trình làm việc trong siêu dữ liệu nội bộ.

Cuối cùng, hãy dự đoán trải nghiệm người dùng. Một biểu tượng mà không có giải thích có thể gây cảm giác an tâm sai lầm. Hãy trình bày rõ ràng những gì được chứng thực: nguồn gốc của tệp, việc sử dụng một công cụ, sự xác nhận của con người hoặc việc không có thay đổi kể từ khi ký.

Các thông báo của Google và Anthropic cho thấy nguồn gốc đang trở thành một viên gạch hạ tầng. Câu trả lời đúng không phải là chọn giữa watermark và C2PA, mà là tích hợp chúng vào một chuỗi quản trị nơi mỗi tín hiệu có phạm vi được biết đến.

Partitech hỗ trợ các tổ chức trong việc thiết kế luồng công việc nội dung AI, tích hợp C2PA, truy xuất nguồn gốc CMS/DAM và đảm bảo tuân thủ vận hành với AI Act.

Chia sẻ bài viết