Situation report active Rev. 2026.9 119 reports 239 source records updated
Real Life After AGI Das Überlebens-Briefing für die Menschheit
DE

Das skeptische Argument gegen AGI in naher Zukunft

Die stärksten technischen Argumente, dass AGI nicht nahe ist, von namentlich genannten Forschern mit realen Referenzen — fair dargestellt, kein Zerrbild.

Written by
Dwight Ringdahl
Status
Quellen geprüft
Revised
Sources
10 cited
Reading
7 min

Warum diese Seite existiert

Der Großteil dieses Handbuchs neigt dazu, AGI-Risiko ernst zu nehmen, da der Großteil davon behandelt, was passiert, wenn die Optimisten recht haben. Diese Haltung macht es leicht, Skeptiker zu einem Strohmann zu verflachen — „sie verstehen einfach Skalierung nicht“ — und weiterzuziehen. Das ist ein Bärendienst gegenüber einer substanziellen Position, die von Forschern vertreten wird, die einige der grundlegenden Werkzeuge des Feldes gebaut haben. Diese Seite stellt ihre tatsächlichen Argumente dar, keine zum Verlieren konstruierte Version, ohne zu schiedsrichtern, wer recht hat; siehe wie man Behauptungen über AGI gewichtet und AGI-Zeitplanprognosen dafür, wie die Meinungsbandbreite normalerweise berichtet wird.

Yann LeCun: kein Weltmodell, keine Planung

Yann LeCun verließ Meta im November 2025 nach zwölf Jahren, einschließlich der Gründung des FAIR-Labors, und war bis März 2026 Executive Chairman und Mitgründer von AMI Labs, einem Pariser Startup, das eine Seed-Runde von 1,03 Milliarden Dollar aufnahm — Berichten zufolge die größte europäische Startup-Seed-Runde überhaupt —, um das zu bauen, was er „Weltmodelle“ nennt (TechCrunch). Das ist bedeutsam: LeCuns Skepsis milderte sich nicht zu einer Absicherung ab — sie verhärtete sich zu einem Unternehmen, auf das er seine Karriere setzt.

LeCuns Einwand ist ein architektonisches Argument, kein Beweis dafür, dass Transformer nicht planen können. Standardmäßige autoregressive Modelle sagen Token ohne ein ausdrückliches, dauerhaftes Weltmodell oder einen separaten Planer voraus. Jeder Modelldurchlauf verwendet einen festen Rechengraphen, doch ein größeres System kann durch das Erzeugen, Bewerten oder Überarbeiten zusätzlicher Token mehr Inferenzrechenleistung einsetzen. Das kann Ergebnisse verbessern, ohne damit geerdete, langfristige Planung nachzuweisen.

LeCun schlägt stattdessen ein konfigurierbares Weltmodell vor, das plausible zukünftige Zustände vorhersagt, verbunden mit einem Akteur, der auf mehreren Abstraktionsebenen nach Handlungen sucht (LeCuns Positionspapier; Metas Forschungsüberblick). Das ist seine vorgeschlagene Forschungsrichtung, keine gesicherte Aussage darüber, was heutige Sprachmodelle niemals leisten können. Die Wette lautet, dass robuste autonome Intelligenz Architekturen benötigt, die aus Video sowie räumlicher und sensomotorischer Erfahrung lernen, nicht nur aus Text.

Andrew Ng: die Evidenzhürde anheben

Andrew Ng — Gründer von DeepLearning.AI, Managing General Partner bei AI Fund und außerordentlicher Professor in Stanford — argumentiert, „AGI ist zu einem Hype-Begriff geworden statt zu einem Begriff mit präziser Bedeutung“, und dass die Branche Jahrzehnte von einem System entfernt ist, das jede intellektuelle Aufgabe ausführen kann, die ein Mensch kann, vom Lkw-Fahren bis zum Schreiben einer Doktorarbeit (PYMNTS). Sein konkreter Beitrag ist methodisch: ein vorgeschlagener „Turing-AGI-Test“, bei dem ein Richter eine mehrtägige Real-Arbeits-Prüfung entwirft — tatsächliche Aufgaben, keine kuratierte Demo — und das System nur besteht, wenn es so gut abschneidet wie ein geübter Mensch. Der Punkt: die Torpfosten von Ranglistenwerten weg und hin zu anhaltender Leistung verschieben, um das zu entschärfen, was er als Blasenrisiko-Hype ansieht.

Gary Marcus: Halluzination, Denkkollaps und die Arithmetik sich summierender Annahmen

Gary Marcus, emeritierter Professor für Psychologie und Neurowissenschaft an der NYU und Gründer von Geometric Intelligence und Robust.AI, hat ein Argument an mehreren Fronten aufgebaut. Zur Zuverlässigkeit: LLMs „kennen buchstäblich nicht den Unterschied zwischen Wahrheit und Falschheit“, und er zitiert einen formalen Beweis, dass sie selbst bei perfekten Daten und unbegrenzter Rechenleistung halluzinieren werden — bestätigt, sagt er, als GPT-5 (August 2025) Halluzination nicht löste und OpenAIs o3 mehr halluzinierte als seine Vorgänger (Marcus on AI). Zum Denken: „wir werden Physik nicht mit Systemen lösen, die keinen Turm von Hanoi mit 8 Scheiben spielen können“ — unter Berufung auf Apples Befund, dass „Denk“-Modelle von LLMs jenseits einer Komplexitätsschwelle kollabieren, statt anmutig zu degradieren.

Seine am breitesten diskutierte Intervention ist methodisch: eine Zerlegung des Prognoseszenarios „AI 2027“ als „Fiktion, verkleidet als Wissenschaft“ — es leiht sich narrative Techniken, während es Zitate und Fußnoten präsentiert, als wäre das Ergebnis eine Prognose. Marcus zerlegt das Szenario in etwa acht aufeinanderfolgende „Vertrauenssprung“-Meilensteine, multipliziert ihre implizierten individuellen Wahrscheinlichkeiten und zeigt, dass die zusammengesetzte Wahrscheinlichkeit, dass die gesamte Kette fristgerecht eintrifft, nahe null liegt (Substack) — untermauert von der eigenen Erfolgsbilanz des Prognostizierens: Halluzinationen 2024 für „gelöst“ erklärt, selbstfahrende Autos angeblich bis 2017 „überall“. Bemerkenswert ist, dass Marcus nicht argumentiert, „AGI ist unmöglich“ — „jeder, der denkt, AGI sei unmöglich“, liege ebenso falsch, sagt er, wie jeder, der denkt, sie sei unmittelbar bevorstehend — und er setzt eine plausible Ankunft nun auf 2100 an, nicht 2027. Diese Haltung selbst ist Evidenz dafür, dass das Skeptikerlager eine Streuung ist, keine einzelne Position — ein Punkt, den auch die Seite Zeitplanprognosen über das Feld als Ganzes macht.

Tim Dettmers: Rechenleistung ist physisch

Tim Dettmers, Forscher am Allen Institute for AI, macht ein Argument, das nicht von der Modellarchitektur abhängt — es geht um Physik. Die GPU-Leistung pro Dollar stagnierte um 2018 herum, argumentiert er, und die meisten sichtbaren Gewinne seither kamen aus numerischer Präzision niedrigerer Genauigkeit — dieselbe Arithmetik billiger durchzuführen — statt aus echtem Rechenleistungswachstum. Er schätzt, dass „vielleicht ein, vielleicht zwei weitere Jahre Skalierung übrig“ sind, bevor Gewinne an Speicher-, I/O- und Stromgrenzen stoßen, wo Energie und Kosten exponentiell für nur lineare Fähigkeitsgewinne wachsen (timdettmers.com). Er fasst „AGI“ so, dass sie wirtschaftlich bedeutsame Kompetenz bei physischen Aufgaben erfordert, keine Benchmark-Werte, und dehnt die Logik bis zu ihrem Endpunkt aus: Eine Superintelligenz würde denselben physischen Beschränkungen begegnen, wenn sie ihren eigenen Inferenz-Stack verbessert. Anders als die obigen Argumente hängt dieses nicht davon ab, speziell bei LLMs recht zu haben — es ist eine Behauptung über das Substrat, auf dem jede digitale Intelligenz läuft.

Die kürzere Liste: siehe auch

Eine kürzere Liste rundet den Fall ab. Rodney Brooks, CTO von Robust.AI und emeritierter Professor für Robotik am MIT, führt eine jährliche, datierte, falsifizierbare Vorhersage-Bewertungstafel — seltene Disziplin unter KI-Kommentatoren — und argumentiert aus Jahrzehnten Robotikerfahrung, dass enger Benchmark-Fortschritt ständig mit allgemeiner Kompetenz verwechselt wird. François Chollet, Schöpfer des ARC-AGI-Benchmarks, verweist auf Modelle, die bei Aufgaben, die zum Widerstehen gegen Auswendiglernen gebaut wurden, nahe null punkten — das neuere ARC-AGI-3 sah 2026 die besten Modelle unter 1 % punkten gegenüber 100 % bei Menschen — als Evidenz, dass Intelligenz Effizienz beim Fähigkeitserwerb ist, nicht Skalierung. Subbarao Kambhampati von Arizona State argumentiert, LLMs könnten unabhängig vom Prompting nicht planen oder sich selbst verifizieren, und stellt inzwischen infrage, ob Gedankenketten-Token überhaupt echtes Denken darstellen. Melanie Mitchell vom Santa Fe Institute argumentiert, LLM-Erfolg spiegle Mustervergleich über Trainingsverteilungen wider statt kausales Denken. Emily Bender, Linguistin an der University of Washington und Mitautorin von „Stochastic Parrots“, argumentiert, flüssige Ausgabe sei Form ohne verankertes Verständnis — Modelle, die darauf trainiert sind, Wortsequenzen vorherzusagen, hätten keinen Zugang zu kommunikativer Absicht.

Die Prognosemethodik selbst ist ein Ziel

Über einzelne Forscher hinaus zielen Skeptiker direkt darauf, wie AGI-Zeitpläne produziert werden. Expertenumfrage-Methodik zeigt einen gut dokumentierten „bewegten Horizont“-Effekt — Befragte platzieren AGI etwa fünfzehn bis fünfundzwanzig Jahre in der Zukunft, unabhängig davon, wann sie gefragt werden — verschärft durch Selektionseffekte und Empfindlichkeit gegenüber der Formulierung. Ein RAND-Bericht vom März 2026 katalogisiert diese Probleme systematisch über Umfrage-, Prognosemarkt- und Rechenleistungs-Extrapolationsmethoden hinweg (RAND).

METRs eigene „Zeithorizont“-Metrik — die Fähigkeitskurve, die am häufigsten als Evidenz für Beschleunigung zitiert wird, und auf der Seite Zeitplanprognosen besprochen — hat Prüfung auf sich gezogen, auch von METR selbst. Ein Hinweis vom Januar 2026 legte eine 35-prozentige Korrektur offen, die auf eine logistische Anpassung mit fester Steigung angewendet wurde, dass etwa ein Drittel der Aufgabenschwierigkeitsschätzungen abgeleitet statt gemessen ist, und dass METR „keine Ahnung“ habe, ob der wahre Zeithorizont eines Modells tatsächlich innerhalb des von ihm berichteten Konfidenzintervalls liegt (METR). Eine Tage zuvor veröffentlichte unabhängige Kritik ging weiter: Die Aufgaben seien unrealistisch sauber, öffentliche Lösungen könnten die Daten kontaminiert haben, und menschliche Basiszeiten stammten aus einer kleinen, finanziell incentivierten Stichprobe, die wahrscheinlich aufgeblasen habe, wie lange Aufgaben „eigentlich“ dauern sollten — wodurch die scheinbare Beschleunigung der KI teilweise ein Artefakt des Vergleichs sei (Transformer News). So oder so, ein großer Teil der Zeitplan-Schlussfolgerungen des Feldes preist von einer einzigen verrauschten Kurvenanpassung um, die ihre eigenen Autoren nicht vollständig verbürgen können.

Das summiert sich mit einem älteren Problem: Goodharts Gesetz, angewendet auf Benchmarks. Sobald ein Benchmark zu einem Optimierungsziel wird, feinabstimmen Labore hin zur Rangliste statt zum Konstrukt, das er misst — MMLU ging von einem 43-Punkte-Wert für GPT-3 gegenüber einer 90-Punkte-menschlichen-Basis im Jahr 2020 zu Top-Modellen über, die sich bis Mitte 2024 so eng gruppierten, dass Unterschiede innerhalb des Rauschens der Prompt-Formatierung liegen. Kontamination durch Benchmark-Leckage macht steigende Werte schwerer als echten Gewinn zu lesen. Siehe wie man Behauptungen über AGI gewichtet und die Fähigkeitsleiter dafür, warum „übertrifft einen Benchmark“ und „erreicht AGI“ unterschiedliche Behauptungen sind.

Was diese Seite nicht behauptet

Nichts davon läuft auf einen Fall hinaus, dass AGI unmöglich ist, und keiner der oben genannten Forscher stellt diese Behauptung auf — Marcus macht explizit deutlich, dass beide Extreme falsch sind. Was es begründet, ist reale Substanz: architektonische Grenzen, die sich nicht offensichtlich mit Skalierung auflösen, eine physische Rechenleistungsobergrenze, die jedem Fahrplan gleichgültig ist, und ein Prognoseapparat, der nach METRs eigenem Eingeständnis die Kurve, die alle zitieren, nicht vollständig verbürgen kann. Ob das zu „Jahrzehnte entfernt“ oder „näher, als diese Seite nahelegt“ zusammenaddiert, ist genau das, was dieses Handbuch sich weigert, für den Leser zu entscheiden. Was es nicht tun wird, ist zuzulassen, dass das skeptische Argument zu einem Zerrbild wird.

References

Summarized position

Yann LeCun proposes a configurable predictive world model and hierarchical planner as a route to grounded reasoning and planning, while arguing that current autoregressive language models lack key ingredients for autonomous intelligence.

Yann LeCun, Professor, NYU; Chief AI Scientist, Meta at publication
A Path Towards Autonomous Machine Intelligence, Primary source
Summarized position

Andrew Ng argues AGI is decades away and has proposed a 'Turing-AGI Test' — a multi-day real-work trial — to raise the evidentiary bar above benchmark-score claims.

Andrew Ng, Founder, DeepLearning.AI; Managing General Partner, AI Fund
PYMNTS, Reported interview
Summarized position

Gary Marcus cites a formal proof that large language models will hallucinate even given perfect data and unlimited compute, and says GPT-5 and OpenAI's o3 failed to resolve the problem.

Gary Marcus, Professor Emeritus of Psychology and Neural Science, NYU; founder, Geometric Intelligence and Robust.AI
Marcus on AI (Substack), Primary source
Summarized position

Gary Marcus calls the 'AI 2027' forecasting scenario fiction dressed as science, arguing its roughly eight sequential technical assumptions compound to a near-zero probability of landing on schedule.

Gary Marcus, Professor Emeritus of Psychology and Neural Science, NYU; founder, Geometric Intelligence and Robust.AI
Marcus on AI (Substack), Primary source
Summarized position

Tim Dettmers argues GPU price-performance plateaued around 2018 and that only one or two more years of meaningful compute scaling remain before physical limits on memory, power and I/O bind.

Tim Dettmers, Researcher, Allen Institute for AI (Ai2)
timdettmers.com, Primary source
Summarized position

METR disclosed that its widely cited 'time horizon' capability curve applies a 35% correction to a fitted logistic curve, and that it has 'no idea' whether any model's true time horizon sits inside the reported confidence interval.

METR, "Clarifying Limitations of Time Horizon" notice
METR, Research/report
Summarized position

Nathan Witkin argues METR's time-horizon benchmark rests on unrealistically clean tasks, possible data contamination from public solutions, and a small, financially incentivized human-baseline sample that inflated apparent AI acceleration.

Nathan Witkin, Contributor, Transformer News
Transformer News, Primary source
Summarized position

RAND Corporation catalogs a 'moving horizon' bias across AGI-timeline surveys, in which forecasters place AGI roughly fifteen to twenty-five years out regardless of when they are asked, plus selection and framing effects.

RAND Corporation, "Artificial General Intelligence Forecasting and Scenario Analysis" report
RAND Corporation, Research/report
  1. TechCrunch techcrunch.com
  2. Metas Forschungsüberblick ai.meta.com

Type to search the manual.

navigate open esc close