Situation report active Rev. 2026.9 119 reports 239 source records updated
Real Life After AGI Pengarahan kelangsungan hidup manusia
ID

Argumen skeptis terhadap AGI jangka pendek

Argumen teknis terkuat bahwa AGI tidak dekat, dari peneliti bernama dengan kredensial nyata—direpresentasikan secara adil, bukan sebagai karikatur untuk dijatuhkan.

Written by
Dwight Ringdahl
Status
Sumber diperiksa
Revised
Sources
10 cited
Reading
7 min

Mengapa halaman ini ada

Sebagian besar manual ini condong menganggap serius risiko AGI, karena sebagian besar isinya membahas apa yang terjadi jika para optimis benar. Sikap itu memudahkan untuk meratakan para skeptis menjadi sebuah strawman—“mereka hanya tidak memahami penskalaan”—lalu melangkah maju. Itu adalah sebuah ketidakadilan bagi posisi substansial yang dipegang oleh para peneliti yang membangun beberapa alat fondasional bidang ini. Halaman ini merepresentasikan argumen sesungguhnya mereka, bukan versi yang dibangun untuk kalah, tanpa mewasiti siapa yang benar; lihat cara menimbang klaim tentang AGI dan prakiraan linimasa AGI untuk bagaimana rentang opini biasanya dilaporkan.

Yann LeCun: tidak ada model dunia, tidak ada perencanaan

Yann LeCun meninggalkan Meta pada November 2025 setelah dua belas tahun, termasuk mendirikan lab FAIR-nya, dan pada Maret 2026 menjadi Ketua Eksekutif dan salah satu pendiri AMI Labs, sebuah startup berbasis Paris yang meraih putaran pendanaan awal (seed) sebesar $1,03 miliar—dilaporkan sebagai putaran pendanaan awal startup Eropa terbesar yang pernah tercatat—untuk membangun apa yang ia sebut “model dunia” (TechCrunch). Itu penting: skeptisisme LeCun tidak melunak menjadi sebuah lindung nilai—melainkan mengeras menjadi sebuah perusahaan yang dipertaruhkannya untuk kariernya.

Keberatan LeCun adalah argumen arsitektural, bukan teorema bahwa transformer tidak dapat merencanakan. Model autoregresif standar memprediksi token tanpa model dunia yang eksplisit dan persisten atau perencana terpisah. Setiap lintasan model memakai grafik komputasi tetap, tetapi sistem yang lebih besar dapat menggunakan lebih banyak komputasi inferensi dengan menghasilkan, menilai, atau merevisi token tambahan. Hal itu dapat memperbaiki hasil tanpa membuktikan adanya perencanaan jangka panjang yang berlandaskan dunia nyata.

Sebagai gantinya, LeCun mengusulkan model dunia yang dapat dikonfigurasi untuk memprediksi keadaan masa depan yang masuk akal, dipasangkan dengan aktor yang mencari tindakan pada beberapa tingkat abstraksi (makalah posisi LeCun; ikhtisar riset Meta). Ini adalah arah riset yang ia usulkan, bukan kesimpulan mapan tentang hal yang tidak akan pernah dapat dilakukan model bahasa saat ini. Taruhannya adalah bahwa kecerdasan otonom yang tangguh memerlukan arsitektur yang belajar dari video serta pengalaman spasial dan sensorimotor, bukan hanya teks.

Andrew Ng: naikkan ambang bukti

Andrew Ng—pendiri DeepLearning.AI, Managing General Partner di AI Fund, dan profesor tambahan di Stanford—berargumen “AGI telah berubah menjadi istilah hype alih-alih istilah dengan makna yang presisi,” dan bahwa industri ini masih berpuluh-puluh tahun lagi dari sebuah sistem yang mampu melakukan tugas intelektual apa pun yang dapat dilakukan manusia, dari mengemudikan truk hingga menulis disertasi doktoral (PYMNTS). Kontribusi konkretnya bersifat metodologis: sebuah “Uji Turing-AGI” yang diusulkan, di mana seorang juri merancang sebuah uji coba kerja nyata multi-hari—tugas sesungguhnya, bukan sebuah demo terkurasi—dan sistem itu lulus hanya jika ia berkinerja sebaik seorang manusia terampil. Intinya: memindahkan target dari skor papan peringkat ke kinerja yang bertahan lama, meredam apa yang ia anggap sebagai hype risiko gelembung.

Gary Marcus: halusinasi, keruntuhan penalaran, dan aritmetika asumsi yang berakumulasi

Gary Marcus, Profesor Emeritus Psikologi dan Ilmu Saraf di NYU dan pendiri Geometric Intelligence dan Robust.AI, telah membangun sebuah kasus multi-front. Tentang keandalan: LLM “secara harfiah tidak tahu perbedaan antara kebenaran dan kepalsuan,” dan ia mengutip sebuah bukti formal bahwa mereka akan berhalusinasi bahkan dengan data sempurna dan komputasi tak terbatas—terbukti, katanya, ketika GPT-5 (Agustus 2025) gagal memecahkan halusinasi dan o3 milik OpenAI berhalusinasi lebih banyak daripada pendahulunya (Marcus on AI). Tentang penalaran: “kita tidak akan memecahkan fisika dengan sistem yang tidak dapat memainkan Menara Hanoi pada menara dengan 8 cakram”—mengutip temuan Apple bahwa model “penalaran” LLM runtuh melewati ambang batas kompleksitas alih-alih menurun secara bertahap.

Intervensinya yang paling banyak dibahas bersifat metodologis: sebuah penjatuhan skenario prakiraan “AI 2027” sebagai “fiksi berbalut sains”—meminjam teknik naratif sambil menyajikan kutipan dan catatan kaki seolah-olah hasilnya adalah sebuah prakiraan. Marcus mendekomposisi skenario itu menjadi kira-kira delapan tonggak “lompatan keyakinan” berurutan, mengalikan probabilitas individual yang tersirat, dan menunjukkan probabilitas gabungan dari seluruh rangkaian yang mendarat sesuai jadwal mendekati nol (Substack)—didukung oleh rekam jejak prakiraan itu sendiri: halusinasi yang dinyatakan “terpecahkan” pada 2024, mobil tanpa pengemudi yang konon “ada di mana-mana” pada 2017. Yang perlu dicatat, Marcus tidak berargumen “AGI tidak mungkin”—“siapa pun yang berpikir AGI tidak mungkin” sama salahnya, katanya, dengan siapa pun yang berpikir itu sudah dekat—dan kini menempatkan kedatangan yang masuk akal pada 2100, bukan 2027. Sikap itu sendiri adalah bukti bahwa kubu skeptis adalah sebuah sebaran, bukan satu posisi tunggal—sebuah poin yang juga dibuat halaman prakiraan linimasa tentang bidang ini secara keseluruhan.

Tim Dettmers: komputasi bersifat fisik

Tim Dettmers, seorang peneliti di Allen Institute for AI, membuat sebuah argumen yang tidak bergantung pada arsitektur model—ini tentang fisika. Kinerja-per-dolar GPU mendatar sekitar 2018, ia berargumen, dan sebagian besar keuntungan yang terlihat sejak itu berasal dari numerik presisi-lebih-rendah—melakukan aritmetika yang sama dengan lebih murah—alih-alih pertumbuhan komputasi yang sejati. Ia memperkirakan “mungkin satu, mungkin dua tahun lagi penskalaan tersisa” sebelum keuntungan itu menabrak dinding memori, I/O, dan daya, di mana energi dan biaya tumbuh secara eksponensial hanya untuk keuntungan kemampuan yang linear (timdettmers.com). Ia membingkai “AGI” sebagai membutuhkan kompetensi yang bermakna secara ekonomi pada tugas fisik, bukan skor tolok ukur, dan memperluas logikanya hingga titik akhirnya: sebuah superkecerdasan akan menghadapi kendala fisik yang sama saat menyempurnakan tumpukan inferensinya sendiri. Tidak seperti argumen-argumen di atas, ini tidak bergantung pada benar atau tidaknya tentang LLM secara spesifik—ini adalah sebuah klaim tentang substrat tempat kecerdasan digital apa pun berjalan.

Daftar yang lebih singkat: lihat juga

Sebuah daftar yang lebih singkat melengkapi kasus ini. Rodney Brooks, CTO Robust.AI dan Profesor Emeritus Robotika di MIT, menjalankan sebuah kartu skor prediksi tahunan, bertanggal, dan dapat difalsifikasi—disiplin yang langka di kalangan komentator AI—dan berargumen dari puluhan tahun pengalaman robotikanya bahwa kemajuan tolok ukur sempit terus dikelirukan sebagai kompetensi umum. François Chollet, pencipta tolok ukur ARC-AGI, menunjuk pada model yang mencetak skor mendekati nol pada tugas yang dibangun untuk menahan hafalan—ARC-AGI-3 yang lebih baru menyaksikan model terbaik 2026 mencetak skor di bawah 1% dibandingkan 100% untuk manusia—sebagai bukti bahwa kecerdasan adalah efisiensi perolehan keterampilan, bukan skala. Subbarao Kambhampati dari Arizona State berargumen LLM tidak dapat merencanakan atau memverifikasi diri sendiri terlepas dari prompting, dan kini mempertanyakan apakah token rantai-pemikiran sungguh merepresentasikan penalaran nyata sama sekali. Melanie Mitchell dari Santa Fe Institute berargumen keberhasilan LLM mencerminkan pencocokan pola atas distribusi pelatihan alih-alih penalaran kausal. Emily Bender, seorang ahli bahasa Universitas Washington dan salah satu penulis “Stochastic Parrots,” berargumen keluaran yang fasih adalah bentuk tanpa pemahaman yang berpijak—model yang dilatih untuk memprediksi urutan kata tidak memiliki akses ke niat komunikatif.

Metodologi prakiraan itu sendiri adalah target

Di luar peneliti individu mana pun, para skeptis membidik langsung bagaimana linimasa AGI dihasilkan. Metodologi survei pakar menunjukkan efek “horizon bergerak” yang terdokumentasi dengan baik—responden menempatkan AGI kira-kira lima belas hingga dua puluh lima tahun lagi terlepas dari kapan mereka ditanya—diperburuk oleh efek seleksi dan sensitivitas susunan kata. Sebuah laporan RAND Maret 2026 mengatalogkan masalah-masalah ini secara sistematis di seluruh metode survei, pasar prediksi, dan ekstrapolasi komputasi sekaligus (RAND).

Metrik “horizon waktu” milik METR sendiri—kurva kemampuan yang paling sering dikutip sebagai bukti akselerasi, dan dibahas pada halaman prakiraan linimasa—telah menarik pengawasan termasuk dari METR sendiri. Sebuah pemberitahuan Januari 2026 mengungkapkan sebuah koreksi 35% yang diterapkan pada sebuah kecocokan logistik kemiringan-tetap, bahwa kira-kira sepertiga estimasi tingkat kesulitan tugas disimpulkan alih-alih diukur, dan bahwa METR “tidak tahu” apakah horizon waktu sebenarnya sebuah model sesungguhnya berada di dalam interval kepercayaan yang dilaporkannya (METR). Sebuah kritik independen yang dipublikasikan beberapa hari sebelumnya melangkah lebih jauh: tugas-tugasnya secara tidak realistis bersih, solusi publik mungkin telah mengontaminasi data, dan waktu garis dasar manusia berasal dari sampel kecil dan berinsentif finansial yang kemungkinan menggelembungkan berapa lama tugas “seharusnya” memakan waktu—membuat akselerasi AI yang tampak sebagian merupakan artefak dari perbandingan itu (Transformer News). Bagaimanapun juga, sebagian besar inferensi linimasa bidang ini memberi harga ulang berdasarkan satu kecocokan kurva yang bising yang bahkan tidak dapat sepenuhnya dijamin oleh penulisnya sendiri.

Itu diperparah dengan masalah yang lebih lama: Hukum Goodhart yang diterapkan pada tolok ukur. Begitu sebuah tolok ukur menjadi target optimisasi, laboratorium menyetel halus menuju papan peringkat alih-alih konstruk yang diukurnya—MMLU bergerak dari skor GPT-3 43 poin dibandingkan garis dasar manusia 90 poin pada 2020 menjadi model-model teratas mengelompok begitu rapat pada pertengahan 2024 sehingga perbedaannya jatuh di dalam derau pemformatan prompt. Kontaminasi kebocoran tolok ukur membuat skor yang naik lebih sulit dibaca sebagai keuntungan yang genuin. Lihat cara menimbang klaim tentang AGI dan tangga kemampuan untuk alasan mengapa “mengalahkan sebuah tolok ukur” dan “mencapai AGI” adalah klaim yang berbeda.

Apa yang tidak diklaim oleh halaman ini

Tidak satu pun dari ini yang menjadi sebuah kasus bahwa AGI tidak mungkin, dan tidak satu pun dari peneliti di atas yang membuat klaim itu—Marcus secara eksplisit menyatakan kedua ekstrem itu salah. Apa yang ditetapkannya adalah substansi nyata: batasan arsitektural yang tidak secara jelas terselesaikan dengan skala, sebuah langit-langit komputasi fisik yang tidak peduli pada peta jalan apa pun, dan sebuah aparatus prakiraan yang, menurut pengakuan METR sendiri, tidak dapat sepenuhnya menjamin kurva yang dikutip semua orang. Apakah itu bertambah menjadi “berpuluh-puluh tahun lagi” atau “lebih dekat daripada yang disarankan halaman ini” adalah persis apa yang menolak diselesaikan manual ini bagi pembaca. Apa yang tidak akan dilakukannya adalah membiarkan kasus skeptis menjadi sebuah karikatur.

References

Summarized position

Yann LeCun proposes a configurable predictive world model and hierarchical planner as a route to grounded reasoning and planning, while arguing that current autoregressive language models lack key ingredients for autonomous intelligence.

Yann LeCun, Professor, NYU; Chief AI Scientist, Meta at publication
A Path Towards Autonomous Machine Intelligence, Primary source
Summarized position

Andrew Ng argues AGI is decades away and has proposed a 'Turing-AGI Test' — a multi-day real-work trial — to raise the evidentiary bar above benchmark-score claims.

Andrew Ng, Founder, DeepLearning.AI; Managing General Partner, AI Fund
PYMNTS, Reported interview
Summarized position

Gary Marcus cites a formal proof that large language models will hallucinate even given perfect data and unlimited compute, and says GPT-5 and OpenAI's o3 failed to resolve the problem.

Gary Marcus, Professor Emeritus of Psychology and Neural Science, NYU; founder, Geometric Intelligence and Robust.AI
Marcus on AI (Substack), Primary source
Summarized position

Gary Marcus calls the 'AI 2027' forecasting scenario fiction dressed as science, arguing its roughly eight sequential technical assumptions compound to a near-zero probability of landing on schedule.

Gary Marcus, Professor Emeritus of Psychology and Neural Science, NYU; founder, Geometric Intelligence and Robust.AI
Marcus on AI (Substack), Primary source
Summarized position

Tim Dettmers argues GPU price-performance plateaued around 2018 and that only one or two more years of meaningful compute scaling remain before physical limits on memory, power and I/O bind.

Tim Dettmers, Researcher, Allen Institute for AI (Ai2)
timdettmers.com, Primary source
Summarized position

METR disclosed that its widely cited 'time horizon' capability curve applies a 35% correction to a fitted logistic curve, and that it has 'no idea' whether any model's true time horizon sits inside the reported confidence interval.

METR, "Clarifying Limitations of Time Horizon" notice
METR, Research/report
Summarized position

Nathan Witkin argues METR's time-horizon benchmark rests on unrealistically clean tasks, possible data contamination from public solutions, and a small, financially incentivized human-baseline sample that inflated apparent AI acceleration.

Nathan Witkin, Contributor, Transformer News
Transformer News, Primary source
Summarized position

RAND Corporation catalogs a 'moving horizon' bias across AGI-timeline surveys, in which forecasters place AGI roughly fifteen to twenty-five years out regardless of when they are asked, plus selection and framing effects.

RAND Corporation, "Artificial General Intelligence Forecasting and Scenario Analysis" report
RAND Corporation, Research/report
  1. TechCrunch techcrunch.com
  2. ikhtisar riset Meta ai.meta.com

Type to search the manual.

navigate open esc close