2026-08-11, tác giả: Ngocthanh

Trong vài năm trở lại đây, trí tuệ nhân tạo tạo sinh (Generative AI) đã phát triển với tốc độ chưa từng có. Chỉ bằng vài dòng mô tả, AI có thể viết một bài báo, tạo một bức ảnh chân thực, thiết kế logo, lập trình phần mềm hay thậm chí xây dựng cả một kế hoạch kinh doanh hoàn chỉnh.

Tin Mới Nhất

Sự phát triển bùng nổ này mang lại nhiều cơ hội, nhưng đồng thời cũng kéo theo một vấn đề ngày càng nghiêm trọng: làm thế nào để biết một nội dung được tạo ra bởi con người hay bởi AI?
Từ tin giả, hình ảnh giả mạo, tài liệu học thuật, bài báo, email lừa đảo cho đến các tác phẩm nghệ thuật số, ranh giới giữa sản phẩm của con người và sản phẩm do AI tạo ra đang ngày càng mờ nhạt.
Để giải quyết vấn đề này, Anthropic – công ty phát triển mô hình AI Claude – vừa công bố một thay đổi quan trọng: mọi nội dung do Claude tạo ra trong tương lai sẽ được gắn watermark (dấu nhận dạng số) và thông tin xác thực nguồn gốc, giúp người dùng cũng như các nền tảng trực tuyến dễ dàng nhận biết đây là nội dung do AI tạo ra. Động thái này được đưa ra nhằm đáp ứng các yêu cầu minh bạch mới của Đạo luật AI của Liên minh châu Âu (EU AI Act).

Một bước ngoặt trong cuộc chiến chống nội dung AI giả mạo


Trong nhiều năm qua, các công ty AI chủ yếu tập trung vào việc nâng cao khả năng của mô hình: viết tốt hơn, lập trình nhanh hơn, tạo hình ảnh đẹp hơn và hiểu ngôn ngữ tự nhiên chính xác hơn.
Tuy nhiên, khi AI ngày càng mạnh, một câu hỏi khác bắt đầu trở nên cấp thiết:
Nếu AI có thể tạo ra nội dung gần như không thể phân biệt với con người, làm sao xã hội biết được đâu là nội dung thật?
Đây không chỉ là vấn đề công nghệ.
Nó còn liên quan đến báo chí, giáo dục, chính trị, luật pháp, bản quyền và niềm tin của người dùng trên Internet.
Một bài báo do AI tạo ra nhưng được đăng dưới tên một con người có thể gây hiểu lầm.
Một hình ảnh giả được lan truyền trên mạng xã hội có thể tạo ra khủng hoảng truyền thông.
Một email giả mạo được AI viết có thể phục vụ cho các chiến dịch lừa đảo.
Trong bối cảnh đó, việc đánh dấu nguồn gốc của nội dung AI đang được xem là một trong những giải pháp quan trọng nhất để xây dựng một hệ sinh thái số minh bạch hơn.

Claude sẽ tự động gắn watermark vào văn bản và hình ảnh


Theo kế hoạch của Anthropic, các mô hình Claude trong tương lai sẽ tự động gắn dấu nhận dạng vào mọi nội dung mà chúng tạo ra.
Điều đặc biệt là những watermark này không thể nhìn thấy bằng mắt thường.
Đối với văn bản, Anthropic sẽ sử dụng một loại watermark vô hình được nhúng trực tiếp vào nội dung do AI tạo ra.
Theo công ty, watermark này không làm thay đổi ý nghĩa, chất lượng hay khả năng đọc của văn bản.
Người dùng vẫn nhìn thấy một đoạn văn hoàn toàn bình thường.
Nhưng bên dưới lớp nội dung đó sẽ tồn tại những dấu hiệu kỹ thuật cho phép các hệ thống chuyên dụng xác định rằng văn bản được tạo bởi Claude.
Đối với hình ảnh, Anthropic sẽ áp dụng chuẩn C2PA (Coalition for Content Provenance and Authenticity) – một tiêu chuẩn đang được nhiều công ty công nghệ lớn như Adobe, Google và OpenAI sử dụng để ghi lại nguồn gốc của nội dung số.

Watermark hoạt động như thế nào?


Nhiều người thường hình dung watermark là một dòng chữ mờ xuất hiện trên bức ảnh.
Tuy nhiên, watermark mà Anthropic sử dụng hoàn toàn khác.
Đây là watermark ở cấp độ máy đọc (machine-readable watermark).
Con người sẽ không nhìn thấy nó khi đọc văn bản hoặc xem hình ảnh.
Thay vào đó, các phần mềm hoặc hệ thống xác minh có thể phát hiện những dấu hiệu đặc biệt được nhúng trong nội dung.
Đối với văn bản, Anthropic cho biết watermark sẽ được tích hợp ngay trong quá trình mô hình tạo nội dung.
Điều này đồng nghĩa với việc watermark không phải là một lớp thông tin bổ sung được thêm vào sau khi văn bản hoàn thành.
Nó trở thành một phần của chính nội dung được tạo ra.

Watermark vẫn tồn tại sau khi sao chép hoặc chỉnh sửa nhẹ


Một trong những vấn đề lớn của watermark truyền thống là chúng rất dễ bị loại bỏ.
Chỉ cần sao chép nội dung sang một nơi khác hoặc chỉnh sửa đôi chút, watermark có thể biến mất.
Anthropic cho biết watermark mới của Claude được thiết kế để bền vững hơn.
Ngay cả khi người dùng sao chép và dán văn bản sang tài liệu khác hoặc thực hiện một số chỉnh sửa nhỏ, watermark vẫn có khả năng tồn tại.
Điều này giúp việc truy vết nguồn gốc của nội dung trở nên đáng tin cậy hơn.
Tuy nhiên, công ty cũng thừa nhận rằng watermark không phải là giải pháp hoàn hảo.
Nếu nội dung bị chỉnh sửa quá nhiều, dịch sang ngôn ngữ khác hoặc được viết lại hoàn toàn, khả năng nhận diện có thể giảm đáng kể.

C2PA là gì?


Đối với hình ảnh, Anthropic lựa chọn tiêu chuẩn C2PA thay vì phát triển một hệ thống riêng.
C2PA là một chuẩn mở được phát triển bởi liên minh gồm nhiều công ty công nghệ và truyền thông lớn.
Mục tiêu của C2PA là tạo ra một "hồ sơ nguồn gốc" cho nội dung số.
Một bức ảnh có thể chứa thông tin về:
Thiết bị đã tạo hoặc ghi lại hình ảnh. Những phần mềm đã chỉnh sửa. Các bước xử lý đã diễn ra. Chữ ký số xác minh tính toàn vẹn. Dữ liệu xác nhận nếu hình ảnh được tạo bởi AI.
Nhờ đó, người dùng hoặc các nền tảng có thể xác minh lịch sử của một tệp hình ảnh thay vì chỉ nhìn vào nội dung hiển thị.

Không chỉ trên Claude, watermark sẽ xuất hiện ở mọi nơi


Anthropic cho biết watermark sẽ được triển khai ở cấp độ mô hình.
Điều này có nghĩa là dù người dùng truy cập Claude thông qua website chính thức, API, Claude Code hay các nền tảng điện toán đám mây như AWS, Google Cloud hoặc Microsoft Foundry, nội dung được tạo ra vẫn sẽ mang dấu nhận dạng giống nhau.
Cách tiếp cận này giúp hạn chế việc người dùng cố tình chuyển sang một nền tảng khác để tạo nội dung không có watermark.

Anthropic cũng sẽ cung cấp công cụ phát hiện watermark


Việc gắn watermark chỉ là một nửa của bài toán.
Muốn hệ thống thực sự hữu ích, cần phải có công cụ để kiểm tra watermark.
Anthropic cho biết họ đang phát triển các công cụ cho phép người dùng, doanh nghiệp và các bên thứ ba xác minh xem một nội dung có được tạo bởi Claude hay không.
Công ty dự kiến sẽ công bố thêm tài liệu kỹ thuật về hệ thống phát hiện này trong thời gian tới.

Động lực lớn đến từ Đạo luật AI của châu Âu


Một trong những lý do quan trọng khiến Anthropic triển khai hệ thống watermark là các quy định mới của EU AI Act.
Đạo luật AI của Liên minh châu Âu bắt đầu có hiệu lực với nhiều yêu cầu mới về tính minh bạch đối với các hệ thống AI tạo sinh.
Theo đó, các công ty phát triển AI cần cung cấp cơ chế giúp phân biệt nội dung do AI tạo ra với nội dung do con người tạo ra.
Anthropic cho biết những mô hình Claude mới sẽ hỗ trợ watermark ngay từ khi phát hành, trong khi các mô hình cũ sẽ được cập nhật dần trong thời gian tới.

Đây không phải là "lá chắn" tuyệt đối


Dù được đánh giá là một bước tiến lớn, chính Anthropic cũng thừa nhận rằng watermark không phải giải pháp hoàn hảo.
Đối với hình ảnh, metadata theo chuẩn C2PA đôi khi có thể bị mất khi người dùng tải ảnh lên một số nền tảng hoặc chỉnh sửa bằng những phần mềm không hỗ trợ chuẩn này.
Đối với văn bản, watermark có thể bị suy yếu nếu nội dung được chỉnh sửa sâu, diễn đạt lại hoặc dịch sang ngôn ngữ khác.
Quan trọng hơn, việc không phát hiện được watermark không đồng nghĩa nội dung chắc chắn do con người tạo ra.
Đó chỉ là dấu hiệu cho thấy hệ thống không tìm thấy bằng chứng rõ ràng về việc nội dung được tạo bởi Claude.

Cuộc đua minh bạch AI đang nóng lên


Anthropic không phải công ty duy nhất theo đuổi hướng đi này.
Trong thời gian gần đây, nhiều doanh nghiệp AI lớn cũng đang đầu tư mạnh vào các công nghệ xác minh nguồn gốc nội dung.
Google đã phát triển SynthID để đánh dấu nội dung AI.
Adobe thúc đẩy hệ thống Content Credentials.
OpenAI cũng đã tham gia các sáng kiến hỗ trợ chuẩn C2PA.
Trong khi đó, Meta gần đây cũng giới thiệu hệ thống riêng nhằm gắn và phát hiện watermark cho nội dung AI trên nền tảng của mình.

Tương lai của Internet có thể thay đổi


Nếu watermark AI được triển khai rộng rãi, cách chúng ta tiếp cận nội dung trên Internet có thể thay đổi đáng kể.
Trong tương lai, người dùng có thể chỉ cần một cú nhấp chuột để biết:
Bài viết này do con người hay AI tạo ra? Hình ảnh này có bị chỉnh sửa hay không? Video này được tạo bằng công cụ nào? Nội dung đã bị thay đổi sau khi phát hành hay chưa?
Điều đó có thể góp phần giảm bớt tình trạng tin giả, deepfake và những nội dung được tạo hàng loạt nhằm thao túng dư luận.

Minh bạch sẽ trở thành tiêu chuẩn mới của AI?


Việc Anthropic đưa watermark vào Claude cho thấy ngành AI đang bước sang một giai đoạn mới.
Nếu những năm đầu là cuộc đua về việc mô hình nào thông minh hơn, nhanh hơn và mạnh hơn, thì giai đoạn tiếp theo có thể sẽ là cuộc cạnh tranh về độ tin cậy và tính minh bạch.
Người dùng không chỉ muốn AI tạo ra nội dung chất lượng.
Họ cũng muốn biết nội dung đó đến từ đâu, được tạo bằng cách nào và liệu có thể xác minh được nguồn gốc hay không.
Watermark không thể giải quyết mọi vấn đề của AI tạo sinh.
Nó không thể ngăn hoàn toàn việc lạm dụng AI, cũng không thể thay thế các biện pháp kiểm chứng thông tin truyền thống.
Tuy nhiên, đây được xem là một bước đi quan trọng để xây dựng một môi trường số minh bạch hơn, nơi nội dung do con người và nội dung do AI có thể cùng tồn tại nhưng không còn bị nhầm lẫn với nhau.
Trong những năm tới, khi ngày càng nhiều mô hình AI tham gia vào cuộc đua gắn watermark và xác thực nguồn gốc, người dùng Internet có thể sẽ bước vào một kỷ nguyên mới – nơi mỗi bức ảnh, mỗi đoạn văn và mỗi video đều mang theo một "dấu vân tay số" giúp kể lại câu chuyện về nguồn gốc của chính nó.

Ý kiến độc giả

feature-top

Đăng bình luận

Thêm Tin Tức »