Mối đe dọa rộng hơn hình ảnh giả
AI có thể giảm chi phí soạn thảo tin nhắn, dịch các chiến dịch, tạo tài khoản giả, bắt chước giọng nói, và điều chỉnh một lập luận. Điều đó có thể khuếch đại gian lận, quấy rối, tuyên truyền, và thông tin chất lượng thấp thông thường. Tuy nhiên, bằng chứng không ủng hộ việc mô tả công chúng hôm nay là bị điều khiển đồng đều bởi AI được cá nhân hóa hoàn hảo.
Các thử nghiệm có kiểm soát cho thấy các hệ thống hội thoại có thể thay đổi quan điểm, nhưng một nghiên cứu lớn năm 2026 với 76.977 người tham gia phát hiện các hiệu ứng cá nhân hóa cơ bản dưới một điểm phần trăm. Việc nhắc lệnh và hậu huấn luyện tập trung vào thuyết phục có hiệu ứng lớn hơn, và những phương pháp đó có liên quan đến độ chính xác thực tế giảm (nghiên cứu của Viện An ninh AI Vương quốc Anh). Báo cáo An toàn AI Quốc tế nói rằng sự thao túng độc hại trong thế giới thực đã được ghi chép nhưng chưa phổ biến rộng rãi (tóm tắt báo cáo 2026).
Bức tranh có chừng mực đó vẫn biện minh cho hành động. Nội dung giá rẻ, khối lượng lớn có thể làm quá tải sự xác minh, nhắm mục tiêu vào những người dễ bị tổn thương, và khiến bằng chứng xác thực dễ bị phủ nhận hơn. Các biện pháp phòng thủ nên tăng cường giao tiếp đáng tin cậy và quyền tự quyết của người dùng thay vì giả định rằng các quan chức hoặc nền tảng có thể tuyên bố tập trung mọi sự thật.
Bảo vệ kênh, không chỉ nội dung
Nhiều chiến dịch gây hại khai thác danh tính và phân phối hơn là một thông điệp tinh vi về mặt kỹ thuật. Một vụ lừa đảo hoạt động vì nó có vẻ đến từ một người quản lý, người thân, ngân hàng, hoặc cơ quan công quyền. Một chiến dịch ảnh hưởng đạt được sức mạnh thông qua các tài khoản được phối hợp và phạm vi tiếp cận được mua. Do đó, những người phòng thủ có thể bảo mật kênh ngay cả khi họ không thể phân loại từng câu.
Các tổ chức nên sử dụng các miền được xác thực, xác thực đa yếu tố chống lừa đảo, các trang liên hệ công khai đã được xác minh, và xác nhận ngoài kênh cho các khoản thanh toán hoặc thay đổi nhạy cảm. Các cơ quan công quyền và tổ chức tin tức nên công bố các kênh khẩn cấp ổn định. Gia đình và nơi làm việc có thể thiết lập một quy tắc kênh thứ hai: các yêu cầu khẩn cấp về tiền, thông tin xác thực, hoặc bí mật được xác nhận bằng một số điện thoại đã biết hoặc trực tiếp.
Các nền tảng có thể phát hiện hành vi phối hợp, yêu cầu xác minh mạnh hơn cho các nhà quảng cáo có phạm vi tiếp cận cao, công bố thông tin nhà tài trợ và nhắm mục tiêu, và giới hạn tốc độ nhắn tin hàng loạt không mong muốn. Những biện pháp này tập trung vào hành vi và phạm vi tiếp cận. Chúng có thể được áp dụng bất kể quan điểm chính trị và cung cấp các tiêu chí kháng nghị rõ ràng hơn so với các phán đoán mơ hồ về ý kiến chấp nhận được.
Nguồn gốc là bằng chứng, không phải một sấm truyền
Chứng chỉ Nội dung dựa trên tiêu chuẩn C2PA có thể đính kèm thông tin đã ký bằng mật mã về việc tạo và chỉnh sửa. Chúng có thể tiết lộ rằng một máy ảnh hoặc công cụ đã biết đã ký một tài sản và liệu metadata đã ký có thay đổi hay không. Chúng không thể xác lập rằng cảnh đó được dàn dựng, chú thích là công bằng, hoặc người ký là trung thực. Tài liệu giải thích C2PA nói rõ ràng rằng chỉ riêng nguồn gốc không thể cho thấy nội dung là đúng hoặc thực tế và rằng metadata có thể bị loại bỏ (giải thích C2PA).
Sự vắng mặt của chứng chỉ không được trở thành bằng chứng của việc bịa đặt. Các thiết bị cũ, nhà xuất bản nhỏ, nhân chứng công dân, và những người trong bối cảnh nguy hiểm có thể không sử dụng tiêu chuẩn này. Các hệ thống cần các tùy chọn bảo vệ quyền riêng tư, xác minh có thể tiếp cận, hỗ trợ chỉnh sửa (redaction), và một cách để sửa chữa một khóa ký bị xâm phạm.
Nguồn gốc hoạt động tốt nhất như một tín hiệu trong xác minh chéo. Một hình ảnh đã ký từ một tòa soạn đáng tin cậy cộng với các nhân chứng độc lập và bằng chứng vị trí mạnh hơn bất kỳ yếu tố đơn lẻ nào.
Phát hiện có vai trò hẹp hơn nhưng hữu ích
Các công cụ phát hiện nội dung tổng hợp có thể giúp phân loại khối lượng lớn hoặc xác định các đặc điểm từ các phương pháp tạo đã biết. Chúng không nên được coi là các thẩm phán quyết định. Hiệu suất có thể giảm trên các mô hình mới, phương tiện đã nén, tệp đã chỉnh sửa, các ngôn ngữ khác nhau, hoặc các ví dụ đối kháng. Các dương tính giả có thể ảnh hưởng không cân xứng đến những người có văn phong khác với dữ liệu huấn luyện.
Bài đánh giá của NIST về các phương pháp minh bạch nội dung tổng hợp mô tả các sự đánh đổi giữa phát hiện, watermarking, metadata, và nguồn gốc và cảnh báo về các khoảng trống về độ mạnh mẽ và bằng chứng (NIST AI 100-4). Hành động rủi ro cao nên yêu cầu xác minh chéo, tỷ lệ lỗi được ghi chép cho bối cảnh liên quan, và xem xét của con người. Chỉ riêng điểm số của một công cụ phát hiện không nên chấm dứt việc làm, kỷ luật một học sinh, hoặc xóa bỏ báo chí.
Xây dựng xác minh vào các thể chế
Các tòa soạn có thể duy trì các bàn xác minh nguồn, bảo tồn các tệp gốc, ghi chép các sửa chữa, và giải thích sự bất định. Các văn phòng bầu cử có thể phản bác trước các tin đồn thủ tục thông thường và duy trì các trang trạng thái chính thức, có thể tiếp cận. Các ngân hàng có thể làm chậm các giao dịch bất thường và hỗ trợ báo cáo gian lận nhanh chóng. Trường học và thư viện có thể dạy đọc theo chiều ngang: rời khỏi bài đăng, xác định nguồn gốc, so sánh báo cáo độc lập, và kiểm tra bằng chứng nào thực sự hỗ trợ tuyên bố.
UNESCO coi hiểu biết về truyền thông và thông tin là một năng lực rộng hơn để tham gia phê phán với thông tin, điều hướng các hệ thống kỹ thuật số, và hiểu AI—không phải một danh sách các nguồn được chấp thuận (hiểu biết truyền thông và thông tin của UNESCO). Các chương trình hiệu quả dạy cách các thể chế tạo ra kiến thức, cách các động lực định hình sự phân phối, và cách sửa đổi niềm tin. Chúng nên bao gồm tuyên truyền lịch sử và các sai sót thông thường cũng như AI tạo sinh.
Các cộng đồng cần những người truyền tin đáng tin cậy trên các ranh giới chính trị, tôn giáo, nghề nghiệp, và văn hóa. Một biện pháp phòng thủ được coi là thuộc về một hệ tư tưởng sẽ thất bại khi thông tin vượt qua ranh giới nhóm. Tính minh bạch về phương pháp, tài trợ, sai sót, và kháng nghị là một phần của hiệu quả.
Ứng phó sự cố cho các cuộc tấn công thông tin
Các tổ chức nên chuẩn bị cho mạo danh, chiếm đoạt tài khoản, phương tiện tổng hợp bị rò rỉ, và các tuyên bố sai được phối hợp trước một cuộc khủng hoảng. Một kế hoạch nên xác định:
- ai có thể xác thực các giao tiếp chính thức;
- các tài khoản bị xâm phạm và khóa ký được thu hồi như thế nào;
- hồ sơ và nhật ký gốc được bảo tồn ở đâu;
- những nền tảng, ngân hàng, kênh thực thi pháp luật, hoặc đối tác nào được liên hệ;
- những người bị ảnh hưởng nhận được các sửa chữa kịp thời như thế nào;
- ai phê duyệt các tuyên bố công khai và cập nhật chúng khi sự thật thay đổi;
- cách đo lường phạm vi tiếp cận và tổn hại còn lại.
Tốc độ quan trọng, nhưng một sự phủ nhận không chính xác có thể phá hủy uy tín. Các tin nhắn ban đầu nên nêu rõ những gì đã biết, chưa biết, và đang được xác minh. Các sửa chữa nên vẫn được liên kết với tuyên bố gốc thay vì âm thầm thay thế nó.
Đối với các hệ thống AI tạo ra hoặc phân phối nội dung, các kiểm soát sự cố nên bao gồm giới hạn tốc độ, đình chỉ, quay lại phiên bản mô hình, thu hồi thông tin xác thực, và nhật ký kiểm toán. Một hệ thống đề xuất có thể cần một chế độ theo thời gian hoặc khuếch đại thấp hơn tạm thời trong khi các nhà điều tra hiểu hành vi bất thường.
Bảo tồn quyền lợi và tính đa nguyên
Bản thân việc bảo vệ thông tin có thể trở thành một nguồn lạm dụng. Giám sát chính phủ, danh tính bắt buộc, danh sách đen bí mật, và các hạn chế nội dung rộng đe dọa quyền riêng tư và bất đồng chính kiến. Các nền tảng tư nhân cũng thực thi quyền lực khổng lồ đối với phạm vi tiếp cận và sinh kế. Các biện pháp bảo vệ đòi hỏi các quy tắc hẹp, tiêu chí trung lập về quan điểm, thông báo, kháng nghị, giám sát độc lập, và báo cáo về sai sót.
Ngôn luận hợp pháp nhưng không được ưa chuộng không phải là một sự cố an ninh. Sự lừa dối có phối hợp, gian lận, mạo danh, và truy cập trái phép thường có thể được giải quyết thông qua các quy tắc dựa trên hành vi mà không giao cho nhà nước quyền lực chung quyết định sự thật. Các nhà nghiên cứu cần quyền truy cập bảo vệ quyền riêng tư vào dữ liệu nền tảng để các tuyên bố về thao túng có thể được đánh giá độc lập.
Cá nhân có thể làm gì
Hãy dừng lại khi một tin nhắn tạo ra sự cấp bách, sợ hãi, giận dữ, hoặc bí mật. Tìm nguồn gốc thay vì tin tưởng vào một ảnh chụp màn hình. Kiểm tra xem liệu nhiều hãng tin độc lập có báo cáo cùng một sự kiện cơ bản hay không, chứ không chỉ lặp lại một bài đăng. Xác minh các yêu cầu khẩn cấp qua một kênh đã biết riêng biệt. Bảo tồn các tin nhắn đáng ngờ để báo cáo, và tránh khuếch đại chúng chỉ để lên án chúng.
Những thói quen này giảm rủi ro, nhưng các cá nhân không thể kiểm tra một luồng công nghiệp một mình. Các nền tảng, nhà quảng cáo, nhà phát triển mô hình, thể chế công, và tổ chức truyền thông kiểm soát các hệ thống tạo ra quy mô. Trách nhiệm phải theo sau sự kiểm soát đó.
Kết luận thực tiễn
Tầng thông tin được bảo vệ thông qua các kênh được xác thực, phân phối có trách nhiệm giải trình, nguồn gốc, phát hiện cẩn thận, xác minh thể chế, hiểu biết, và ứng phó sự cố đã được thực hành. Không cái nào giải quyết được vấn đề một mình. Nguồn gốc không chứng minh sự thật; phát hiện không cung cấp sự chắc chắn; hiểu biết không biện minh cho các nền tảng không an toàn.
Mục tiêu không phải là khiến mọi người không tin tưởng vào mọi thứ. Đó là làm cho bằng chứng đáng tin cậy dễ xác minh hơn, quy mô lừa dối khó mua hơn, các sai sót dễ sửa chữa hơn, và quyền lực thể chế dễ thách thức hơn.