Situation report active Rev. 2026.9 119 reports 239 source records updated
Real Life After AGI Bản tin sinh tồn của nhân loại
VI

04 Lối thoát

Những lối thoát thực sự tồn tại

Các biện pháp kiểm soát kỹ thuật và thể chế quyết định liệu các kịch bản nghiêm trọng trong chương 02 trở nên khả dĩ hơn hay ít khả dĩ hơn; sự chuẩn bị của hộ gia đình không thể thay thế cho chúng.

Written by
Dwight Ringdahl
Sources
2 cited

Các đòn bẩy an toàn kỹ thuật

  • Nghiên cứu về khả năng diễn giải. Kiểm tra các biểu diễn của mô hình và tính toán nội bộ như một biện pháp bổ sung cho các đánh giá hành vi, kiểm soát truy cập và giám sát triển khai.
  • Giám sát có thể mở rộng. Các kỹ thuật — tranh luận, mô hình hóa phần thưởng đệ quy, khái quát hóa từ yếu đến mạnh — nhằm giúp những người giám sát kém năng lực hơn có thể giám sát các hệ thống có năng lực cao hơn.
  • Nghiên cứu về khả năng sửa chữa. Nghiên cứu cách các hệ thống có thể duy trì sự cởi mở đối với việc sửa chữa, chỉnh sửa và tắt hợp pháp; chưa có giải pháp nào được chứng minh là vững chắc ở quy mô lớn.
  • Quản trị năng lực tính toán. Các biện pháp kiểm soát xuất khẩu theo từng khu vực pháp lý, giám sát hạ tầng và các ngưỡng được dùng như các đại lượng thay thế không hoàn hảo cho năng lực — không phải là một định nghĩa về AGI hay về an toàn.

Giám đốc điều hành của Anthropic đã lập luận cho điều đầu tiên trong số này trong bài luận năm 2025 của ông về chủ đề này:

Summarized position

Dario Amodei argues that researchers still lack a precise account of why models choose particular outputs.

Dario Amodei, CEO, Anthropic
The Urgency of Interpretability, Primary source

Các đòn bẩy thể chế

Vấn đề phối hợp

Sự phối hợp quốc tế quan trọng vì các biện pháp kiểm soát đơn phương có thể thay đổi cả động cơ an toàn lẫn vị thế cạnh tranh. Bối cảnh chính sách không còn hoàn toàn mang tính tự nguyện: Đạo luật AI của EU áp đặt các nghĩa vụ ràng buộc đối với các nhà cung cấp thuộc phạm vi điều chỉnh, trong khi các khung an toàn của phòng thí nghiệm và các cam kết tại hội nghị thượng đỉnh vẫn phần lớn mang tính tự nguyện. Hiện chưa có hiệp ước kiểm soát vũ trang mô hình tiên phong mang tính ràng buộc toàn cầu nào tồn tại.

Một điểm khởi đầu quốc tế ban đầu là bản tuyên bố không ràng buộc được 28 quốc gia và EU tán thành tại hội nghị thượng đỉnh toàn cầu đầu tiên về an toàn AI:

Summarized position

28 nations and the European Union commits signatories to AI that is designed, developed, deployed and used safely and responsibly.

28 nations and the European Union, The Bletchley Declaration, AI Safety Summit
GOV.UK, Signed statement
  • Đánh giá trước khi triển khai tương xứng với rủi ro đối với các năng lực nguy hiểm trước khi phát hành không hạn chế.
  • Báo cáo sự cố cho phép các nhà quản lý và nhà phát triển học hỏi từ các thất bại nghiêm trọng và các tình huống suýt xảy ra sự cố.
  • Các quy tắc trách nhiệm pháp lý tính đến quyền kiểm soát, kiến thức, quan hệ nhân quả và khả năng ngăn chặn tổn hại.

Một nhà công nghệ cá nhân có thể làm gì

Độc giả có thể ảnh hưởng đến chính sách với tư cách là cử tri, người lao động, nhà nghiên cứu, khách hàng, nhà đầu tư và thành viên của các tổ chức dân sự. Các lựa chọn thực tế bao gồm đóng góp cho hoặc tài trợ nghiên cứu về khả năng diễn giải và sự phù hợp; thúc đẩy các thực hành an toàn trong chính tổ chức của bạn nếu bạn triển khai các hệ thống AI trong sản xuất; ủng hộ hạ tầng báo cáo và đánh giá nêu trên thay vì coi đó là rào cản pháp lý; và kiểm tra nguồn gốc và bằng chứng đằng sau các tuyên bố có sức thuyết phục thay vì mặc định đó là sự thao túng tự động hoặc sự đồng thuận thực sự.

Nghiên cứu Chính sách Tổ chức

Type to search the manual.

navigate open esc close