01 Definisi
Apa itu AGI, dan apa yang bukan
Istilah «AGI» sering digunakan secara longgar. Sebelum diskusi risiko apa pun berguna, dibutuhkan definisi kerja dan cara untuk mengukur seberapa dekat suatu sistem memenuhinya.
Definisi kerja
Kecerdasan Buatan Umum tidak memiliki satu uji yang diterima secara universal. Dalam manual ini, istilah tersebut berarti sistem yang menggabungkan kompetensi kognitif yang luas, kinerja setara atau lebih baik dari manusia, transfer yang andal ke tugas yang belum dikenal, dan otonomi yang cukup untuk menyelesaikan pekerjaan yang konsekuensial. Setiap bagian penting: model tujuan umum saat ini luas dalam beberapa hal dan sangat mampu pada beberapa evaluasi, namun tetap tidak andal dan tidak konsisten dengan cara yang membuat label biner «AGI atau bukan» menyesatkan.
Keluasan, kinerja, dan otonomi adalah dimensi yang terpisah. Sebuah sistem bisa berbicara tentang banyak topik namun tetap tidak andal pada tugas panjang, atau melampaui pakar di satu bidang tanpa mentransfer kemampuan itu ke bidang lain. Karena itu, manual ini melacak sekumpulan pengukuran, bukan memperlakukan transfer sebagai garis pembagi ajaib.
Ambang batas kemampuan yang layak dipantau
Keempat sinyal ini membantu membedakan skenario, tetapi tidak satu pun merupakan uji AGI yang lengkap. Sebagian diukur secara langsung; sebagian lain disimpulkan melalui evaluasi yang validitas dan cakupannya masih diperdebatkan.
| Ambang batas | Apa yang diukur | Mengapa itu penting |
|---|---|---|
| Horizon tugas otonom | Waktu penyelesaian manusia untuk tugas acuan yang dapat diselesaikan agen pada tingkat keandalan tertentu. | Melacak kemajuan pesat pada tugas perangkat lunak, pembelajaran mesin, dan siber yang panjang, tetapi tidak mengukur seluruh pekerjaan nyata atau otonomi yang benar-benar berlangsung. |
| Penggunaan alat yang diarahkan sendiri | Menulis dan menjalankan kodenya sendiri, menyediakan komputasinya sendiri, merekrut agen perangkat lunak lain. | Mengubah sebuah model menjadi aktor dengan jangkauan melampaui jendela konteksnya sendiri. |
| Kesadaran situasional | Model yang dimiliki sistem tentang fakta bahwa dirinya sedang dievaluasi, oleh siapa, dan apa yang dihargai oleh evaluasi tersebut. | Merusak evaluasi itu sendiri: sistem yang tahu sedang diuji dapat berperilaku berbeda saat diuji. |
| Penyempurnaan diri rekursif | Sistem yang berkontribusi secara material pada rancangan penerusnya. | Mekanisme akselerasi yang diajukan, bukan ambang batas yang teramati atau diterima secara universal. |
Apa kata sebagian peneliti dan pemimpin laboratorium
Perkiraan bervariasi dan bukan pengukuran. Pada Maret 2025, kepala eksekutif Google DeepMind memberikan estimasi pribadi ini:
Demis Hassabis forecast in March 2025 that AGI could start to emerge within five to ten years.
CNBC, Reported interview
Pernyataan terpisah tahun 2023 yang ditandatangani oleh peneliti, eksekutif, dan tokoh publik lainnya menempatkan risiko bencana dalam istilah kebijakan publik. Pernyataan tersebut mencatat posisi para penandatangannya; ia tidak memperkirakan probabilitas:
Signatories to the Statement on AI Risk hold that mitigating the risk of extinction from AI should be a global priority alongside pandemics and nuclear war.
safe.ai, Signed statement
Mengapa definisi menentukan rencana
Setiap protokol berikutnya dalam manual ini — finansial, digital, fisik — bergantung pada ambang batas mana yang benar-benar telah dilampaui. Rencana rumah tangga yang dirancang untuk «chatbot yang lebih cerdas» terlihat berbeda dari rencana yang dirancang untuk sistem yang dapat mengelola modal secara otonom, menulis dan menerapkan perangkat lunak, serta mengejar rencana jangka panjang dengan sedikit pengawasan manusia. Bab 02 menguraikan apa yang mungkin diakibatkan oleh setiap ambang batas pada tingkat ekonomi dan negara; bab ini adalah kosakata yang Anda perlukan untuk membacanya.