Blog

Anthropic

Anthropic ist ein Anfang 2021 in San Francisco gegründetes KI-Sicherheitsunternehmen, das von Dario Amodei, Daniela Amodei und mehreren ehemaligen OpenAI-Mitarbeitenden gegründet wurde und mit der Claude-Sprachmodellfamilie eines der führenden Frontier-Modell-Unternehmen der Gegenwart betreibt.

Anthropic versteht sich explizit als safety-first-Unternehmen und hat mit Constitutional AI (Bai u. a. 2022), dem Responsible Scaling Policy-Rahmen (RSP, September 2023) und umfangreicher Interpretierbarkeitsforschung eigenständige Beiträge zur KI-Sicherheitsforschung geleistet.

Zugleich zählt Anthropic zu den am höchsten kapitalisierten privaten KI-Unternehmen weltweit: Eine Series-G-Runde vom 12. Februar 2026 (30 Milliarden US-Dollar Investment, 380 Milliarden US-Dollar Bewertung; Anthropic 2026, Series H) und eine Series-H-Runde vom 28. Mai 2026 (65 Milliarden US-Dollar Investment unter Führung von Altimeter, Dragoneer, Greenoaks und Sequoia, 965 Milliarden US-Dollar Post-Money-Bewertung; TechCrunch 2026, Series H) folgten aufeinander.

Hinzu kamen strategische Zusatzinvestitionen von Google, angekündigt am 24. April 2026 (bis zu 40 Milliarden US-Dollar zusätzlich; CNBC 2026, Google-Investition), und von Amazon, angekündigt am 20. April 2026 (bis zu 25 Milliarden US-Dollar zusätzlich; CNBC 2026, Amazon-Investition).

Diese Konstellation wird in der Sekundärliteratur als struktureller Widerspruch zwischen erklärter Sicherheitsorientierung und kommerziellem Wachstumsdruck diskutiert.

Anthropic reichte am 1. Juni 2026 vertraulich ein S-1-Formular für einen möglichen Börsengang bei der US-Börsenaufsicht SEC ein. Stand 2025/2026 betreibt Anthropic die Claude-3- und Claude-4-Modellfamilien sowie die neueren Modelle Claude Mythos 5 und Claude Fable 5 (9. Juni 2026) und Claude Sonnet 5 (30. Juni 2026) als kommerzielle API- und Konsumentenprodukte und konkurriert mit OpenAI und Google DeepMind um die Frontier-Modell-Führerschaft.

Zusammenfassung

Anthropic entstand aus einem kollektiven Austritt von elf OpenAI-Mitarbeitenden im April 2021, die nach eigenen Angaben und kulturelle Differenzen über die Priorisierung von KI-Sicherheitsforschung gegenüber Produktentwicklung als Hauptmotiv nannten.

Die Unternehmensstruktur ist als Public Benefit Corporation (PBC) verfasst – eine Rechtsform, die einen gesellschaftlichen Auftrag neben dem Gewinnziel verankert, aber weniger restriktiv ist als eine gemeinnützige Organisation.

Wissenschaftlich hat Anthropic drei einflussreiche Beitragslinien entwickelt. Erstens Constitutional AI als Trainingsparadigma für wertealignierte Sprachmodelle ohne ausschließliche Abhängigkeit von menschlichem Feedback (Bai u. a. 2022).

Zweitens Mechanistic Interpretability als systematisches Forschungsprogramm zur Analyse interner Modellrepräsentationen, das mit Arbeiten zu Superposition, Sparse Autoencoders und Circuit Analysis eigenständige Beiträge geliefert hat (Elhage u. a. 2021; Cunningham u. a. 2023).

Drittens Scaling-Sicherheitsforschung, die die Beziehung zwischen Modellgröße, Fähigkeiten und Risikoprofilen empirisch untersucht.

Die Modellentwicklung verlief von Claude 1 (März 2023) über Claude 2 und 2.1 (2023), Claude 3 (März 2024, drei Varianten: Haiku, Sonnet, Opus) bis zu Claude 3.5 und den Claude-4-Modellen (2025).

Geschichte

Gründung und Austritt aus OpenAI (2020/2021)

Dario Amodei verließ OpenAI Ende Dezember 2020; Anthropic wurde Anfang 2021 gegründet und in Kalifornien registriert. Zum genauen Gründungstag weichen die Angaben voneinander ab.

Zu den Gründerinnen und Gründern gehörten Dario Amodei (ehemaliger VP of Research bei OpenAI) und Daniela Amodei (ehemalige VP of Operations). Weitere Mitgründende waren unter anderem Tom Brown (Leitautor des GPT-3-Papers), Chris Olah (bekannt für Visualisierungsarbeiten zu neuronalen Netzen), Sam McCandlish, Jack Clark, Jared Kaplan (Erstautor der Scaling-Laws-Arbeit) und Deep Ganguli.

Dario und Daniela Amodei sind Geschwister; ihre familiäre Partnerschaft an der Unternehmensleitung ist in der Sekundärliteratur als für Tech-Unternehmen ungewöhnliche Führungsstruktur hervorgehoben worden.

Die öffentlich kommunizierte Hauptmotivation für den Austritt aus OpenAI war die Einschätzung, dass KI-Sicherheitsforschung bei OpenAI gegenüber Produktentwicklung und kommerzieller Expansion methodisch unterpriorisiert wurde. Der Austritt weiterer OpenAI-Sicherheitsforschender (Jan Leike, Ilya Sutskever, Mai 2024) hat diese Einschätzung später teilweise öffentlich bestätigt.

Anthropic nahm im Gründungsjahr eine erste Finanzierungsrunde über 124 Millionen US-Dollar auf; eine Series-B-Runde über 580 Millionen US-Dollar folgte im April 2022.

Frühe Forschungsphase und Constitutional AI (2021–2023)

In den Jahren 2021 und 2022 publizierte Anthropic einflussreiche Arbeiten, die seine doppelte Identität als Sicherheitsforschungs- und Modellentwicklungsunternehmen begründeten.

A Mathematical Framework for Transformer Circuits (Elhage u. a. 2021) legte die theoretische Grundlage für das Mechanistic-Interpretability-Programm. Toy Models of Superposition (Elhage u. a. 2022, arXiv: 2209.10652) analysierte, wie neuronale Netze mehr Features als Dimensionen durch Superposition enkodieren – eine zentrale Beobachtung für das Verständnis interner Modellrepräsentationen.

Constitutional AI: Harmlessness from AI Feedback (Bai u. a. 2022, arXiv: 2212.08073) führte einen neuen Trainingsansatz ein. Statt ausschließlich menschliches Feedback zu nutzen, wird ein Sprachmodell darin trainiert, seine eigenen Ausgaben anhand einer expliziten Verfassung (constitution) – einer Sammlung von Prinzipien – zu kritisieren und zu überarbeiten.

Das resultierende Verfahren RLAIF (Reinforcement Learning from AI Feedback) reduziert die Abhängigkeit von menschlicher Annotation und wurde als Alternative zu OpenAIs RLHF diskutiert.

Claude 1 und erste Modellveröffentlichungen (März 2023)

Im März 2023 veröffentlichte Anthropic Claude 1 als API-Zugang für ausgewählte Partner – zeitlich wenige Wochen nach GPT-4 (OpenAI, März 2023). Claude 1 war das erste Modell, das explizit auf der Constitutional-AI-Methodik trainiert worden war. Die öffentliche Kommunikation betonte Helpful, Harmless, and Honest (HHH) als Zieldimensionen – ein Rahmen, der von Askell u. a. (2021, arXiv: 2112.00861) für Anthropic entwickelt worden war.

Responsible Scaling Policy (September 2023)

Im September 2023 veröffentlichte Anthropic als erstes Frontier-Lab eine Responsible Scaling Policy (RSP) – ein öffentliches Dokument, das definiert, unter welchen Bedingungen das Unternehmen Modelle trainieren, einsetzen oder zurückhalten wird.

Die RSP führte das Konzept der AI Safety Levels (ASL-1 bis ASL-4) ein – angelehnt an die Biosicherheits-Klassifikation BSL-1 bis BSL-4 –, das Fähigkeits- und Risikoschwellen für Modelle beschreibt und automatische Einsatzbeschränkungen bei Überschreitung festlegt.

Die RSP wurde in der Sekundärliteratur als interessantes Selbstverpflichtungsinstrument diskutiert; Kritiker wiesen darauf hin, dass Unternehmen ihre eigenen Schwellenwerte definieren und damit keine externe Verifikation stattfindet (Anderljung u. a. 2023; Shevlane u. a. 2023).

Großinvestitionen und Bewertungsexpansion (2023–2026)

Im September 2023 sagte Amazon bis zu 4 Milliarden US-Dollar zu und sicherte sich als Teil der Vereinbarung Cloud-Computing-Kapazitäten bei AWS; im Oktober 2023 folgte Google mit bis zu 2 Milliarden US-Dollar, davon 500 Millionen sofort.

Im März 2024 schloss Anthropic eine weitere Runde über 2,75 Milliarden US-Dollar ab. Die kumulierte externe Finanzierung überstieg damit 7 Milliarden US-Dollar; die Post-Money-Bewertung wurde auf über 60 Milliarden US-Dollar geschätzt.

Im November 2024 erhöhte Amazon sein Investment um weitere 4 Milliarden US-Dollar auf kumulativ 8 Milliarden US-Dollar (GeekWire 2024). Diese Kapitalstruktur – mit Google und Amazon als strategischen Hauptinvestoren, die zugleich Technologiepartner und Wettbewerber sind – ist in der KI-Governance-Literatur als strukturell spannungsreich diskutiert (vgl. Crawford 2021).

Diese Kapitaldynamik setzte sich 2026 fort: Am 12. Februar 2026 schloss Anthropic eine Series-G-Runde über 30 Milliarden US-Dollar bei einer Bewertung von 380 Milliarden US-Dollar ab; am 28. Mai 2026 folgte eine Series-H-Runde über 65 Milliarden US-Dollar unter Führung von Altimeter, Dragoneer, Greenoaks und Sequoia, die die Post-Money-Bewertung auf 965 Milliarden US-Dollar hob (Anthropic 2026, Series H; TechCrunch 2026, Series H).

Am 20. April 2026 kündigte Amazon eine zusätzliche Investition von bis zu 25 Milliarden US-Dollar an (CNBC 2026, Amazon-Investition); am 24. April 2026 kündigte Google eine zusätzliche Investition von bis zu 40 Milliarden US-Dollar an (CNBC 2026, Google-Investition). Am 1. Juni 2026 reichte Anthropic vertraulich ein S-1-Formular bei der SEC ein – ein früher Schritt in Richtung eines Börsengangs (Anthropic 2026, S-1; CNBC 2026, IPO).

Claude 3 und Modellentwicklung 2024–2025

Im März 2024 veröffentlichte Anthropic Claude 3 in drei Varianten: Claude 3 Haiku (kleinstes, schnellstes Modell), Claude 3 Sonnet (mittlere Leistungsklasse) und Claude 3 Opus (leistungsstärkstes). Claude 3 Opus übertraf GPT-4 auf mehreren Benchmark-Dimensionen zum Zeitpunkt der Veröffentlichung.

Im Juni 2024 folgte Claude 3.5 Sonnet, das auf Coding-Benchmarks State-of-the-Art-Ergebnisse erzielte; im Oktober 2024 Claude 3.5 Haiku. Die Claude-4-Modellfamilie (Claude Sonnet 4.5, Claude Opus 4 u. a.) wurde 2025 eingeführt.

Mechanistic Interpretability als Forschungsprogramm (2021–2026)

Anthropics Interpretierbarkeitsforschung hat seit 2021 eine eigenständige Linie entwickelt. Toy Models of Superposition (Elhage u. a. 2022) und Folgearbeiten zu Sparse Autoencoders (Cunningham u. a. 2023, arXiv: 2309.08600; Bricken u. a. 2023) haben Methoden etabliert, neuronale Netz-Aktivierungen in interpretierbare Merkmalsräume zu zerlegen.

Die Arbeit Towards Monosemanticity: Decomposing Language Models with Dictionary Learning (Bricken u. a. 2023) und Scaling and Evaluating Sparse Autoencoders (Gao u. a. 2024) sind die bislang umfangreichsten öffentlich zugänglichen Interpretierbarkeitsarbeiten an großen Sprachmodellen.

Die Mapping the Mind of a Large Language Model-Arbeit (Templeton u. a. 2024) identifizierte im Claude-3-Sonnet-Modell über eine Million Features mit semantisch interpretierbaren Eigenschaften.

Kritik

Die Spannung zwischen erklärter Sicherheitsorientierung und kommerzieller Expansion ist das zentrale Kritikthema in der Sekundärliteratur. Anthropic trainiert und vertreibt Frontier-Modelle, die nach eigener Einschätzung potenziell gefährliche Fähigkeiten aufweisen könnten – und finanziert diese Tätigkeit durch kommerzielle Einnahmen, die ein beschleunigtes Scaling erfordern.

Dario Amodei und Anthropic haben diese Position in mehreren öffentlichen Beiträgen als bewusste Entscheidung verteidigt: Ein sicherheitsorientiertes Labor an der Frontier sei besser als die Alternative, das Feld weniger sicherheitsorientierten Akteuren zu überlassen (Anthropic 2023, Core Views; Amodei 2024).

Kritiker wie Timnit Gebru und Émile P. Torres werfen dieser Argumentation vor, Sicherheitsrhetorik als Legitimationsinstrument für beschleunigtes Wachstum einzusetzen (Gebru/Torres 2024).

Die Investitionen von Google und Amazon werfen Fragen zur Unabhängigkeit von Anthropics Sicherheitsforschung auf: Beide Investoren sind zugleich Infrastrukturpartner (Google TPUs, AWS) und potenzielle Nutznießer der entwickelten Technologie; eine externe Überprüfung der RSP-Schwellen findet nicht statt.

Die Machines of Loving Grace-Publikation (Dario Amodei, Oktober 2024) – ein Essay, der beschreibt, wie transformative KI in wenigen Jahren Wissenschaft, Medizin und Wirtschaft revolutionieren könnte – wurde von Teilen der kritischen KI-Forschungsgemeinschaft als Beschleunigungsrhetorik eingestuft, die von konkreten gegenwärtigen Schadensfragen ablenkt.

Stand 2025/2026

Stand Mai 2026 ist Anthropic mit der Claude-4-Modellfamilie einer der drei führenden Frontier-Anbieter.

Schätzungen zur Mitarbeitendenzahl reichen von rund 2.500 bis 5.000 (Stand März 2026, Tracxn 2026).

Der annualisierte Umsatz (ARR) erreichte im April 2026 einen Run-Rate von rund 30 Milliarden US-Dollar – eine rund 80-fache Wachstumsrate gegenüber dem Vorjahr (VentureBeat 2026). Bis Ende Mai 2026 stieg er weiter auf rund 47 Milliarden US-Dollar, wie Anthropic zusammen mit der Series-H-Runde bekanntgab. Der Umsatz im zweiten Quartal 2026 lag bei etwa 10,9 Milliarden US-Dollar (VentureBeat 2026; Anthropic 2026, Series H; CNBC 2026, Umsatzwachstum).

Mit Claude Mythos 5, Claude Fable 5 (9. Juni 2026) und Claude Sonnet 5 (30. Juni 2026) hat Anthropic seine Modellpalette im Frühsommer 2026 um weitere Generationen erweitert (TechCrunch 2026, Sonnet 5). Die Mechanistic-Interpretability-Forschungsgruppe ist die nach wissenschaftlichem Output produktivste öffentlich sichtbare Interpretierbarkeits-Einheit unter den Frontier-Labs.

Die RSP wurde 2024 um spezifischere ASL-3-Testprotokolle erweitert. Anthropics Verhältnis zu OpenAI ist methodisch und institutionell kompetitiv; die Übernahme ehemaliger OpenAI-Sicherheitsforschender (Jan Leike wechselte im Mai 2024 zu Anthropic, wo er das Alignment-Science-Team leitet) intensiviert diesen Wettbewerb.

Verwandte Begriffe

Quellenangaben

  1. Amodei, Dario, 2024. Machines of Loving Grace: How AI Could Transform the World for the Better. darioamodei.com, Oktober 2024.
  2. Anderljung, Markus u. a., 2023. Frontier AI Regulation: Managing Emerging Risks to Public Safety. arXiv: 2307.03718.
  3. Anthropic, 2023. Claude’s Constitution. anthropic.com/news, 9. Mai 2023.
  4. Anthropic, 2023. Anthropic’s Responsible Scaling Policy. anthropic.com, September 2023, mehrfach aktualisiert 2024/2025.
  5. Anthropic, 2023. Core Views on AI Safety: When, Why, What, and How. Anthropic, März 2023. anthropic.com.
  6. Anthropic, 2026. Anthropic Raises $65B in Series H Funding. Anthropic, 28. Mai 2026. anthropic.com/news/series-h.
  7. Anthropic, 2026. Anthropic Confidentially Submits Draft S-1 to the SEC. Anthropic, 1. Juni 2026. anthropic.com/news/confidential-draft-s1-sec.
  8. Askell, Amanda u. a., 2021. A General Language Assistant as a Laboratory for Alignment. Anthropic. arXiv: 2112.00861.
  9. Bai, Yuntao u. a., 2022. Constitutional AI: Harmlessness from AI Feedback. Anthropic. arXiv: 2212.08073.
  10. Bricken, Trenton / Templeton, Adly / Batson, Joshua u. a., 2023. Towards Monosemanticity: Decomposing Language Models With Dictionary Learning. Transformer Circuits Thread, Anthropic.
  11. CNBC, 2026. Google to Invest up to $40 Billion in Anthropic as Search Giant Spreads Its AI Bets. CNBC, 24. April 2026. cnbc.com.
  12. CNBC, 2026. Amazon to Invest up to $25 Billion in Anthropic as Part of AI Infrastructure Deal. CNBC, 20. April 2026. cnbc.com.
  13. CNBC, 2026. Anthropic Revenue: Explosive Growth, IPO Path and a Profitable Quarter. CNBC, 20. Mai 2026. cnbc.com.
  14. CNBC, 2026. Anthropic confidentially files IPO prospectus with SEC, prepping Wall Street for landmark AI deal. CNBC, 1. Juni 2026. cnbc.com.
  15. Crawford, Kate, 2021. Atlas of AI: Power, Politics, and the Planetary Costs of Artificial Intelligence.
  16. Cunningham, Hoagy u. a., 2023. Sparse Autoencoders Find Highly Interpretable Features in Language Models. arXiv: 2309.08600.
  17. Elhage, Nelson u. a., 2021. A Mathematical Framework for Transformer Circuits. In: Transformer Circuits Thread, Anthropic.
  18. Elhage, Nelson u. a., 2022. Toy Models of Superposition. In: Transformer Circuits Thread, Anthropic. arXiv: 2209.10652.
  19. Gao, Leo / la Tour, Tom Dupré / Tillman, Henk u. a., 2024. Scaling and Evaluating Sparse Autoencoders. OpenAI. arXiv: 2406.04093.
  20. Gebru, Timnit / Torres, Émile P., 2024. The TESCREAL Bundle: Eugenics and the Promise of Utopia through Artificial General Intelligence. In: First Monday 29 (4). DOI: 10.5210/fm.v29i4.13636.
  21. GeekWire, 2024. Amazon Doubles Total Investment in Anthropic to $8B, Deepens AI Partnership with Claude Maker. GeekWire, 22. November 2024. geekwire.com.
  22. Shevlane, Toby u. a., 2023. Model Evaluation for Extreme Risks. DeepMind / Anthropic. arXiv: 2305.15324.
  23. TechCrunch, 2026. Anthropic Raises $65 Billion, Nears $1T Valuation Ahead of IPO. TechCrunch, 28. Mai 2026. techcrunch.com.
  24. TechCrunch, 2026. Anthropic Launches Claude Sonnet 5 as a Cheaper Way to Run Agents. TechCrunch, 30. Juni 2026. techcrunch.com.
  25. Templeton, Adly u. a., 2024. Scaling Monosemanticity: Extracting Interpretable Features from Claude 3 Sonnet. In: Transformer Circuits Thread, Anthropic.
  26. Tracxn, 2026. Anthropic – Company Profile and Employee Estimates. Tracxn, Stand März 2026. tracxn.com.
  27. VentureBeat, 2026. Anthropic’s Annualized Revenue Hits $30 Billion Run Rate. VentureBeat, Mai 2026. venturebeat.com.

← Zurück zur Lexikon-Übersicht