01 Tanımlar
AGI nedir, ve ne değildir
“AGI” terimi gelişigüzel kullanılıyor. Herhangi bir risk tartışması işe yarar olmadan önce, çalışan bir tanıma ve belirli bir sistemin bu tanımı ne kadar karşıladığını anlamanın bir yoluna ihtiyaç var.
Çalışma tanımı
Yapay Genel Zekâ'nın tek bir kabul görmüş testi yoktur. Bu kılavuzda geniş bilişsel yetkinliği, insanla kıyaslanabilir veya daha iyi performansı, tanıdık olmayan görevlere güvenilir aktarımı ve önemli işleri tamamlayacak kadar özerkliği birleştiren bir sistem anlamına gelir. Her bir parça önemlidir: günümüzün genel amaçlı modelleri bazı açılardan geniş kapsamlı ve bazı değerlendirmelerde dikkat çekici derecede yetenekli olsa da, ikili bir “AGI mi değil mi” etiketini yanıltıcı kılacak şekilde güvenilmez ve düzensiz kalmaya devam ediyor.
Genellik, performans ve özerklik birbirinden ayrı boyutlardır. Bir sistem birçok konuda sohbet edebilirken uzun görevlerde güvenilmez kalabilir, ya da bir alanda uzmanları geçerken bu yeteneği başka bir yere aktaramayabilir. Bu nedenle bu kılavuz, aktarımı sihirli bir ayrım çizgisi olarak ele almak yerine bir dizi ölçümü takip eder.
Takip edilmeye değer yetenek eşikleri
Bu dört sinyal senaryoları birbirinden ayırmaya yardımcı olur, ancak hiçbiri eksiksiz bir AGI testi değildir. Bazıları doğrudan ölçülür; diğerleri geçerliliği ve kapsamı tartışmalı kalan değerlendirmeler yoluyla çıkarım yoluyla elde edilir.
| Eşik | Neyi ölçer | Neden önemli |
|---|---|---|
| Özerk görev ufku | Bir ajanın belirtilen bir güvenilirlik düzeyinde tamamlayabildiği referans görevlerin insan tamamlama süresi. | Yazılım, makine öğrenmesi ve siber güvenlikte uzun görevlerdeki hızlı ilerlemeyi izler, ancak tüm gerçek işleri veya gerçek anlamda geçen özerkliği ölçmez. |
| Kendi kendine yönelik araç kullanımı | Kendi kodunu yazmak ve çalıştırmak, kendi hesaplama kaynağını sağlamak, diğer yazılım ajanlarını devreye almak. | Bir modeli, kendi bağlam penceresinin ötesine uzanan bir aktöre dönüştürür. |
| Durumsal farkındalık | Bir sistemin değerlendirildiğine, kimin tarafından değerlendirildiğine ve bu değerlendirmenin neyi ödüllendirdiğine dair kendi modeli. | Değerlendirmenin kendisini baltalar: test edildiğini bilen bir sistem, test altında farklı davranabilir. |
| Özyinelemeli kendini geliştirme | Bir sistemin kendi ardılının tasarımına önemli ölçüde katkıda bulunması. | Önerilen bir hızlandırma mekanizmasıdır, gözlemlenen veya evrensel olarak kabul edilmiş bir eşik değildir. |
Bazı araştırmacılar ve laboratuvar liderleri ne diyor
Tahminler değişkendir ve ölçüm değildir. Mart 2025'te Google DeepMind'ın CEO'su bu kişisel tahmini paylaştı:
Demis Hassabis forecast in March 2025 that AGI could start to emerge within five to ten years.
CNBC, Reported interview
Araştırmacılar, yöneticiler ve diğer kamuoyu figürleri tarafından imzalanan 2023 tarihli ayrı bir bildiri, felaket riskini politika terimleriyle ele aldı. Bildiri, imzacılarının tutumunu kaydeder; bir olasılık tahmini sunmaz:
Signatories to the Statement on AI Risk hold that mitigating the risk of extinction from AI should be a global priority alongside pandemics and nuclear war.
safe.ai, Signed statement
Tanım neden planı belirliyor
Bu kılavuzda daha sonra yer alan her protokol — finansal, dijital, fiziksel — bu eşiklerden hangisinin gerçekten aşıldığına bağlıdır. "Daha akıllı sohbet botları" için kurulmuş bir hane planı, sermayeyi özerk şekilde yönetebilen, yazılım yazıp dağıtabilen ve çok az insan denetimiyle uzun vadeli planlar izleyebilen bir sistem için kurulmuş bir plandan farklı görünür. Bölüm 02, her eşiğin ekonomi ve devlet düzeyinde neyi ima edebileceğini ele alır; bu bölüm ise onu okumak için ihtiyacınız olan kelime dağarcığıdır.