Situation report active Rev. 2026.9 119 reports 239 source records updated
Real Life After AGI Bản tin sinh tồn của nhân loại
VI

07 Cơ chế

Các cơ chế đằng sau những kết cục tồi tệ nhất

Chương 02 bao gồm cơ chế mất quyền kiểm soát chung. Chương này là bảng ghi các con đường cụ thể, có tên gọi mà các nhà nghiên cứu thực sự nghiên cứu — vì biện pháp can thiệp ngăn chặn con đường này không nhất thiết ngăn chặn được con đường khác.

Written by
Dwight Ringdahl
Sources
3 cited

Vì sao đây không phải là một kịch bản duy nhất

“AI có thể giết chết tất cả mọi người” nén nhiều kiểu thất bại khác biệt về mặt cấu trúc thành một hình ảnh duy nhất. Sự nén đó hữu ích cho một tiêu đề và vô ích cho việc phòng ngừa, vì các biện pháp can thiệp kỹ thuật và chính sách giải quyết một cơ chế có thể ít tác dụng với cơ chế khác — chẳng hạn, các biện pháp kiểm soát đối với một lượt huấn luyện lớn, tự bản thân chúng không ngăn chặn được việc lạm dụng một mô hình đã được triển khai. Hơn 350 nhà nghiên cứu và giám đốc điều hành, bao gồm những người có liên kết với một số phòng thí nghiệm lớn, đã ký một tuyên bố một câu vào năm 2023 kêu gọi các nhà hoạch định chính sách coi rủi ro tuyệt chủng là ưu tiên toàn cầu. Nó ghi lại một lập trường được các người ký tên nổi bật nắm giữ; nó không đo lường xác suất của tổn hại:

Summarized position

Signatories to the Statement on AI Risk hold that mitigating the risk of extinction from AI should be a global priority alongside pandemics and nuclear war.

Signatories to the Statement on AI Risk, Researchers, executives, and other public figures; statement hosted by the Center for AI Safety
safe.ai, Signed statement

Ba nhóm lớn

Báo cáo An toàn AI Quốc tế năm 2026 sử dụng ba nhóm lớn. Sử dụng ác ý là việc con người cố ý điều hướng năng lực AI vào tổn hại hàng loạt — đại dịch được thiết kế, tấn công hạ tầng, hoặc vũ khí tự động. Trục trặc bao gồm các thất bại về độ tin cậy và các kịch bản mất quyền kiểm soát tiềm năng, trong đó các hệ thống hoạt động ngoài tầm kiểm soát của bất kỳ ai. Rủi ro hệ thống phát sinh qua việc triển khai rộng rãi và sự tương tác thể chế, bao gồm sự tập trung, gián đoạn lao động và sự mất quyền lực dần dần của con người. Các loại có thể chồng lấp nhau, và độ mạnh của bằng chứng khác nhau giữa các cơ chế. Chủ tịch của báo cáo đã công khai nhấn mạnh về mất quyền kiểm soát:

Summarized position

Yoshua Bengio warned that future systems exhibiting self-preservation behavior could create a loss-of-control risk.

Yoshua Bengio, Turing Award laureate; chair, International AI Safety Report
AFP, via TechXplore, Secondary coverage

Geoffrey Hinton cũng đã đưa ra một ước tính xác suất cá nhân. Đó là nhận định chuyên gia dưới sự bất định, không phải một tần suất đã đo lường được:

Summarized position

Geoffrey Hinton said in a December 2024 BBC interview that he put the chance of AI causing human extinction within thirty years at 10–20%.

Geoffrey Hinton, Nobel and Turing Award laureate; former VP, Google
BBC Radio 4, reported by The Guardian, Secondary coverage

Chương này không làm gì

Ranh giới biên tập

Mỗi trang phân biệt bằng chứng đã ghi nhận với dự báo và lý thuyết, đồng thời nêu tên các biện pháp giảm thiểu mà các nhà nghiên cứu đề xuất. Không trang nào mô tả chi tiết về tổng hợp, khai thác hoặc tấn công — thông tin đó sẽ không làm cho độc giả an toàn hơn, và việc công bố nó không phải là điều mà sự chuẩn bị có hiểu biết đòi hỏi. Xem tiêu chuẩn nguồn dẫn để biết cách các tuyên bố có hệ quả được phân loại và rà soát.

Type to search the manual.

navigate open esc close