Blog

Ilya Sutskever

Ilya Sutskever (* 8. Dezember 1986 in Nischni Nowgorod, Sowjetunion) ist ein russisch-israelisch-kanadischer Informatiker und einer der einflussreichsten Akteure der jüngeren Geschichte des maschinellen Lernens. Als Doktorand von Geoffrey Hinton an der University of Toronto war er Mit-Autor der wegweisenden AlexNet-Arbeit (Krizhevsky/Sutskever/Hinton 2012), die als Beginn der heutigen Deep-Learning-Ära gilt.

2015 gründete er mit Sam Altman, Greg Brockman, Elon Musk und anderen OpenAI mit; bis Mai 2024 war er dort Chief Scientist und prägte unter anderem die Architektur der GPT-Modellfamilie.

Nach der OpenAI-Govern-Krise im November 2023 – in der Sutskever zeitweise eine zentrale Rolle bei der Entlassung und späteren Wiedereinsetzung von Sam Altman spielte – verließ er das Unternehmen im Mai 2024. Im Juni 2024 gründete er mit Daniel Gross und Daniel Levy das Unternehmen Safe Superintelligence Inc. (SSI).

Nach dem Weggang von Mitgründer Daniel Gross im Juli 2025 zu Meta Superintelligence Labs übernahm Sutskever offiziell die Rolle des CEO von SSI.

Zusammenfassung

Ilya Sutskever ist eine der wenigen Personen, deren wissenschaftliche, kommerzielle und sicherheitsstrategische Beiträge zur Entwicklung großer Sprachmodelle in vergleichbarem Maß alle drei Ebenen betreffen.

Wissenschaftlich war er an drei kanonischen Arbeiten beteiligt: AlexNet (NeurIPS 2012, mit Krizhevsky und Hinton), Sequence to Sequence Learning with Neural Networks (NeurIPS 2014, mit Vinyals und Le) und der GPT-Reihe (Mit-Autor von GPT-2 und GPT-3, OpenAI 2019/2020).

Kommerziell war er Mit-Gründer und langjähriger Chief Scientist von OpenAI; das Unternehmen entwickelte unter seiner wissenschaftlichen Leitung GPT-3, ChatGPT und GPT-4 und prägte damit die öffentliche Wahrnehmung großer Sprachmodelle seit November 2022. Sicherheitsstrategisch ist Sutskever ein expliziter Befürworter der These, dass Superintelligenz – im Sinne der TESCREAL-Tradition.

Mit der Gründung von Safe Superintelligence Inc. (SSI) im Juni 2024 hat er diese Position institutionell verankert; das Unternehmen erklärte als seinen einzigen Forschungsgegenstand den Bau einer „safe superintelligence”.

Sutskever gründete SSI gemeinsam mit dem ehemaligen Apple-Manager Daniel Gross und dem ehemaligen OpenAI-Forscher Daniel Levy. SSI sammelte in einer Seed-Runde im September 2024 1 Mrd. US-Dollar bei einer Bewertung von 5 Mrd. US-Dollar ein.

In einer von Greenoaks Capital angeführten Series-A-Runde kamen im April 2025 weitere 2 Mrd. US-Dollar bei einer Bewertung von 30 bis 32 Mrd. US-Dollar hinzu, ohne dass SSI bis Stand Juni 2026 ein kommerzielles Produkt vorgestellt hätte.

Nach dem Weggang von Gross im Juli 2025 zu Meta Superintelligence Labs führt Sutskever SSI seither offiziell als CEO.

Biografie

Frühe Jahre und Ausbildung

Ilya Sutskever wurde 1986 in Nischni Nowgorod (damals Sowjetunion, heute Russland) geboren und wanderte 1991 mit seiner Familie nach Israel aus, wo er bis zum Alter von 16 Jahren in Jerusalem aufwuchs. 2002 zog die Familie nach Kanada. Er studierte Informatik an der University of Toronto und schloss seine Promotion 2013 bei Geoffrey Hinton ab.

Toronto-Zeit und AlexNet (2012)

Während seiner Promotion war Sutskever an der wissenschaftlich folgenreichsten Arbeit der jüngeren Deep-Learning-Geschichte beteiligt: Gemeinsam mit Alex Krizhevsky und Geoffrey Hinton publizierte er 2012 ImageNet Classification with Deep Convolutional Neural Networks (NeurIPS 2012).

Die Arbeit gewann den ImageNet-Wettbewerb 2012 mit einem Top-5-Fehler von 15,3 % gegenüber dem zweitplatzierten Beitrag mit 26,2 % und markierte den breiten Durchbruch tiefer neuronaler Netze in der Computer Vision. Im Anschluss gründeten die drei das Start-up DNNresearch, das im März 2013 von Google übernommen wurde.

Google Brain (2013–2015)

Von 2013 bis Ende 2015 arbeitete Sutskever bei Google Brain. In dieser Zeit publizierte er mit Oriol Vinyals und Quoc Le die Arbeit Sequence to Sequence Learning with Neural Networks (NeurIPS 2014, arXiv 1409.3215), die das Seq2Seq-Paradigma für maschinelle Übersetzung etablierte und eine Vorstufe der späteren Transformer-Architektur war.

Mit-Gründung und Forschungsleitung OpenAI (2015–2024)

Im Dezember 2015 verließ Sutskever Google, um OpenAI gemeinsam mit Sam Altman, Greg Brockman, Elon Musk, Wojciech Zaremba, John Schulman und anderen mitzugründen. Das Unternehmen war ursprünglich als gemeinnützige Forschungseinrichtung mit dem Ziel angetreten, sicherheitsorientierte Forschung an Künstlicher Allgemeiner Intelligenz zu betreiben.

Sutskever übernahm die Rolle des Chief Scientist und prägte die wissenschaftliche Ausrichtung des Unternehmens in den folgenden neun Jahren. Unter seiner wissenschaftlichen Leitung entstanden die GPT-Modellreihe (GPT-1, GPT-2, GPT-3, ChatGPT, GPT-4), DALL·E und weitere methodisch und kommerziell prägende Modelle.

OpenAI-Govern-Krise (November 2023)

Am 17. November 2023 entließ der OpenAI-Vorstand – zu dem Sutskever zu diesem Zeitpunkt gehörte – den Mit-Gründer und CEO Sam Altman.

Die offizielle Begründung verwies auf einen Vertrauensverlust; die zugrundeliegenden Konflikte sind in der Sekundärliteratur unterschiedlich dargestellt worden und betrafen mehrere Themen, darunter die Geschwindigkeit der Produktveröffentlichungen, das Verhältnis zwischen kommerziellen Zielen und Sicherheitsforschung sowie die Governance-Struktur des Unternehmens.

Innerhalb weniger Tage kündigten über 700 OpenAI-Mitarbeitende einen Massen-Austritt an, falls Altman nicht wiedereingesetzt würde; Sutskever unterzeichnete den entsprechenden offenen Brief. Am 22. November 2023 wurde Altman als CEO wiedereingesetzt, der Vorstand wurde umgebildet, und Sutskever schied aus dem Vorstand aus. In einer Twitter-Mitteilung erklärte Sutskever, er bedaure seine Rolle in den Vorgängen.

Austritt aus OpenAI und Safe Superintelligence Inc. (2024)

Am 14. Mai 2024 gab Sutskever seinen Austritt aus OpenAI bekannt. Wenige Stunden später kündigte auch Jan Leike, gemeinsam mit Sutskever Co-Leiter des OpenAI Superalignment-Teams, seinen Austritt an; er warf dem Unternehmen in einer öffentlichen Erklärung vor, Sicherheitsforschung gegenüber Produktentwicklung zu vernachlässigen.

Am 19. Juni 2024 kündigten Sutskever, Daniel Gross (ehemals Apple, Y Combinator) und Daniel Levy (ehemals OpenAI) die Gründung von Safe Superintelligence Inc. (SSI) mit Standorten in Palo Alto und Tel Aviv an. Das Unternehmen erklärte als ausdrückliches Ziel den Bau einer sicheren Superintelligenz.

In einer Seed-Runde im September 2024 sammelte SSI 1 Mrd. US-Dollar bei einer Bewertung von 5 Mrd. US-Dollar ein. In einer im April 2025 von Greenoaks Capital angeführten Series-A-Runde kamen weitere 2 Mrd. US-Dollar bei einer Bewertung von 30 bis 32 Mrd. US-Dollar hinzu, ohne dass SSI bis Stand Juni 2026 ein öffentliches Produkt vorgestellt hätte.

Führungswechsel, Wachstum und Meta-Übernahmeversuch (2025)

Die Mitarbeiterzahl von SSI wuchs von rund 20 Personen im März 2025 auf rund 50 Personen im Juli 2025. In der ersten Hälfte des Jahres 2025 unternahm Meta einen Versuch, SSI zu übernehmen; Sutskever lehnte das Angebot ab.

Im Juli 2025 verließ Mitgründer Daniel Gross SSI und wechselte zu Meta Superintelligence Labs; im Anschluss übernahm Sutskever offiziell die Rolle des CEO von SSI. Die von SSI vertretene „No-Product-Doctrine” – der Verzicht auf die Veröffentlichung kommerzieller Zwischenprodukte zugunsten der alleinigen Konzentration auf sichere Superintelligenz – gilt Stand Juni 2026 unverändert: Das Unternehmen hat bis dahin kein Produkt veröffentlicht.

Wissenschaftliches Werk

AlexNet (2012)

ImageNet Classification with Deep Convolutional Neural Networks (Krizhevsky/Sutskever/Hinton, NeurIPS 2012) ist die wissenschaftlich folgenreichste Einzelarbeit, an der Sutskever beteiligt war. Die Arbeit demonstrierte die praktische Überlegenheit tiefer Convolutional Neural Networks und legte die methodische Grundlage der seitherigen Deep-Learning-Ära.

Sequence to Sequence Learning (2014)

Die mit Oriol Vinyals und Quoc Le publizierte Arbeit Sequence to Sequence Learning with Neural Networks (NeurIPS 2014) etablierte das Encoder-Decoder-Paradigma für maschinelle Übersetzung und wurde zur Vorlage für die spätere Transformer-Architektur. Die Arbeit wird in der Sekundärliteratur als eines der wenigen wissenschaftlich essenziellen Vorbilder des heutigen Sprachmodell-Paradigmas anerkannt.

GPT-Reihe und Skalierungshypothese

Sutskever war Mit-Autor von GPT-2 (Radford u. a. 2019) und GPT-3 (Brown u. a., NeurIPS 2020). In Vorträgen und Interviews zwischen 2019 und 2024 vertrat er die Skalierungshypothese explizit: Die qualitativen Fähigkeiten großer Sprachmodelle entstehen primär aus der Skalierung von Modellgröße, Daten und Rechenleistung. Diese Position ist in der KI-Forschung kontrovers (vgl. Eintrag Scaling Laws und Emergent Abilities).

Positionen zu KI-Sicherheit und Superintelligenz

Sutskever hat in einer Reihe öffentlicher Aussagen, Interviews und Vorträge die Position vertreten, dass Artificial General Intelligence (AGI) und Superintelligenz in den nächsten Jahren oder Jahrzehnten entstehen könnten und dass ihre Sicherheit höchste Priorität habe.

Eine in der Sekundärliteratur viel zitierte Twitter-Aussage vom Februar 2022 lautete sinngemäß, „es kann sein, dass die heutigen großen neuronalen Netze leicht bewusst sind”. Diese Formulierung erregte in der Forschungsöffentlichkeit substantielle Aufmerksamkeit und Kritik, etwa durch Yann LeCun und Murray Shanahan. Sutskever selbst hat solche Aussagen später relativiert.

In einem von OpenAI publizierten Aufsatz vom Juli 2023 (Mit-Autor mit Jan Leike, Introducing Superalignment) erklärte Sutskever das Ziel, innerhalb von vier Jahren das Problem der Alignment von Superintelligenz zu lösen. Das Superalignment-Team wurde nach den Austritten von Sutskever und Leike im Mai 2024 von OpenAI aufgelöst.

Die Gründung von Safe Superintelligence Inc. im Juni 2024 ist die institutionelle Verlängerung dieser Position.

SSI hat in seiner Gründungserklärung formuliert, dass das Unternehmen sich ausschließlich der Entwicklung einer „safe superintelligence” widmet und keine intermediären kommerziellen Produkte verfolgt. Diese Selbstpositionierung knüpft an die TESCREAL-Tradition (Gebru/Torres 2024) an, ohne dass Sutskever sich öffentlich mit dem TESCREAL-Akronym identifiziert.

Einordnung

Sutskever ist und biografisch ein zentraler Knotenpunkt der jüngeren KI-Geschichte und verbindet mehrere Hauptstränge:

Hinton-Werk-Reihe: Als Hinton-Doktorand und Mit-Autor von AlexNet steht Sutskever in direkter Nachfolge der von Hinton begründeten Deep-Learning-Tradition. Die Sequence-to-Sequence-Arbeit von 2014 bildet die Brücke zur Transformer-Architektur.

TESCREAL-Anschluss: Sutskevers Aussagen zu Superintelligenz, AGI und Alignment sind methodisch und rhetorisch eng mit dem TESCREAL-Cluster verbunden, insbesondere mit Singularitarianismus, Superintelligenz, AI Alignment und Existenziellem Risiko. Anders als Nick Bostrom oder Eliezer Yudkowsky ist Sutskever kein expliziter Vertreter einer philosophischen Schule; seine Position ist primär technisch-praktisch formuliert.

OpenAI als institutionelle Achse: Mit OpenAI verbindet Sutskever den Eintrag zu Large Language Models mit dem Eintrag zu RLHF, in dem OpenAIs InstructGPT-Arbeit eine zentrale Rolle spielt.

Kontrast zu kritischen Stimmen: Sutskevers technisch-optimistische Skalierungshypothese steht im Spannungsfeld zu kritischen Stimmen wie Bender, Gebru, Mitchell oder LeCun, die in den entsprechenden Einträgen behandelt werden.

Kontroversen und Kritik

Substantielle Kritik betrifft mehrere Aspekte:

Anthropomorphisierung: Sutskevers Aussagen zur potentiellen Bewusstheit großer Sprachmodelle (Februar 2022) wurden von zahlreichen Forschenden (LeCun, Marcus, Shanahan) als unhaltbar kritisiert. In der Sekundärliteratur (Bender u. a. 2021) gelten solche Aussagen als Beispiel für die anthropomorphisierende Wahrnehmung von LLMs.

OpenAI-Govern-Krise: Sutskevers Rolle bei der Entlassung von Sam Altman im November 2023 ist in der Sekundärliteratur unterschiedlich bewertet worden. Sutskever selbst hat sein Vorgehen in einer Twitter-Mitteilung öffentlich bedauert.

Sicherheitsrhetorik und Geschäftsstrategie: Die Selbstpositionierung von SSI als rein sicherheitsorientiertes Unternehmen – bei gleichzeitiger Annahme massiver Risikokapital-Investitionen – wird in der Sekundärliteratur kritisch diskutiert. Die Frage, wie safe superintelligence operationalisiert wird, ist von SSI bislang nicht öffentlich beantwortet worden.

Superalignment-Auflösung: Die Auflösung des OpenAI-Superalignment-Teams nach den Austritten Sutskever/Leike im Mai 2024 wurde in der Sekundärliteratur als Indiz dafür diskutiert, dass die institutionelle Verankerung von Sicherheitsforschung in kommerziellen KI-Unternehmen strukturell instabil sein könnte.

Verwandte Begriffe

Quellenangaben

  1. Bender, Emily M. / Gebru, Timnit / McMillan-Major, Angelina / Shmitchell, Shmargaret, 2021. On the Dangers of Stochastic Parrots: Can Language Models Be Too Big? In: Proceedings of the 2021 ACM Conference on Fairness, Accountability, and Transparency (FAccT 2021), S. 610–623. DOI: 10.1145/3442188.3445922.
  2. Bostrom, Nick, 2014. Superintelligence: Paths, Dangers, Strategies.
  3. Rooney, Kate, 2025. Meta tried to buy Safe Superintelligence, hired CEO Daniel Gross. CNBC, 19. Juni 2025.
  4. Brown, Tom B. u. a., 2020. Language Models are Few-Shot Learners. In: Advances in Neural Information Processing Systems 33 (NeurIPS 2020), S. 1877–1901. arXiv: 2005.14165.
  5. Gebru, Timnit / Torres, Émile P., 2024. The TESCREAL Bundle: Eugenics and the Promise of Utopia through Artificial General Intelligence. In: First Monday 29 (4). DOI: 10.5210/fm.v29i4.13636.
  6. Ha, Anthony, 2025. OpenAI Co-Founder Ilya Sutskever’s Safe Superintelligence Reportedly Valued at $32B. TechCrunch, 12. April 2025.
  7. Knight, Will, 2023. OpenAI’s Ilya Sutskever Has a Plan for Keeping Super-Intelligent AI in Check. WIRED, 14. Dezember 2023.
  8. Krizhevsky, Alex / Sutskever, Ilya / Hinton, Geoffrey E., 2012. ImageNet Classification with Deep Convolutional Neural Networks. In: Advances in Neural Information Processing Systems 25 (NeurIPS 2012), S. 1097–1105.
  9. Leike, Jan / Sutskever, Ilya, 2023. Introducing Superalignment. OpenAI, 5. Juli 2023.
  10. Leike, Jan, 2024. „I joined because I thought OpenAI would be the best place in the world to do this research” – Twitter-Thread zum Austritt aus OpenAI, 17. Mai 2024.
  11. Radford, Alec u. a., 2019. Language Models are Unsupervised Multitask Learners. OpenAI Technical Report. (GPT-2).
  12. Roose, Kevin, 2023. Inside OpenAI’s Crisis Over the Future of Artificial Intelligence. The New York Times, Dezember 2023.
  13. Roth, Emma, 2024. OpenAI’s Former Chief Scientist Is Starting a New AI Company. The Verge, 19. Juni 2024.
  14. Safe Superintelligence Inc., 2024. Safe Superintelligence Inc. Gründungsankündigung, 19. Juni 2024.
  15. Sutskever, Ilya / Vinyals, Oriol / Le, Quoc V., 2014. Sequence to Sequence Learning with Neural Networks. In: Advances in Neural Information Processing Systems 27 (NeurIPS 2014), S. 3104–3112. arXiv: 1409.3215.
  16. Sutskever, Ilya, 2022. „it may be that today’s large neural networks are slightly conscious”. Twitter-Mitteilung, Februar 2022.

← Zurück zur Lexikon-Übersicht