Anthropic ist ein amerikanisches Unternehmen für künstliche Intelligenz, das 2021 von ehemaligen OpenAI-Forschern gegründet wurde. Das Unternehmen konzentriert sich auf die Entwicklung sicherer und interpretierbarer Systeme für künstliche Intelligenz, mit besonderem Schwerpunkt auf der Ausrichtung des KI-Verhaltens an menschlichen Absichten. Sein Hauptprodukt ist die Claude-Familie von großen Sprachmodellen, die in verschiedenen Anwendungen eingesetzt werden, darunter Konversationsassistenten, Programmierhilfe und Unternehmensdatenanalyse. Anthropic hat seinen Hauptsitz in San Francisco, Kalifornien, und hat sich zu einer der führenden unabhängigen KI-Forschungsorganisationen entwickelt, die mit Unternehmen wie OpenAI und Google DeepMind konkurriert.
Das Unternehmen wurde als Reaktion auf Bedenken hinsichtlich der Sicherheit und ethischer Implikationen fortgeschrittener KI gegründet. Seine Gründer, darunter Dario Amodei und Daniela Amodei, hatten zuvor leitende Positionen bei OpenAI inne, wo sie an Modellen wie GPT-2 und GPT-3 arbeiteten. Anthropics Ansatz zur KI-Sicherheit basiert auf einem Forschungsprogramm namens „Constitutional AI“, das darauf abzielt, Modelle zu trainieren, einer Reihe von Prinzipien oder einer „Verfassung“ zu folgen, um ihr Verhalten zu leiten und den Bedarf an umfangreichem menschlichem Feedback zu reduzieren.
Gründung und frühe Geschichte
Anthropic wurde 2021 von einer Gruppe von sieben Personen gegründet, von denen die meisten ehemalige OpenAI-Mitarbeiter waren. Das Gründungsteam umfasste Dario Amodei (ehemaliger Vizepräsident für Forschung bei OpenAI), Daniela Amodei (ehemalige Vizepräsidentin für Sicherheit und Politik), Tom Brown (ein wichtiger Beitragender zu GPT-3), Chris Olah (ehemaliger Leiter der Interpretierbarkeit), Jared Kaplan, Jack Clark und Sam McCandlish. Das Unternehmen operierte zunächst im Stealth-Modus und sammelte erhebliche Mittel von Investoren, darunter die Muttergesellschaft von Alibaba Cloud, obwohl die genauen Finanzierungsdetails zu diesem Zeitpunkt nicht öffentlich bekannt gegeben wurden.
Anfang 2023 kündigte Anthropic eine bedeutende Partnerschaft mit Google Cloud an, die eine große Investition und die Verpflichtung umfasste, die Cloud-Infrastruktur von Google für das Training und die Bereitstellung seiner Modelle zu nutzen. Später im selben Jahr erhielt das Unternehmen auch eine bedeutende Investition von Amazon Web Services (AWS), das zu seinem primären Cloud-Anbieter für Training und Inferenz wurde. Diese Partnerschaften verschafften Anthropic die für das Training großer Modelle notwendigen Rechenressourcen.
Constitutional AI und Sicherheitsforschung
Ein prägendes Merkmal der Forschung von Anthropic ist der Fokus auf Constitutional AI (CAI). Dieser Ansatz beinhaltet das Training von Modellen mithilfe einer Reihe expliziter Regeln oder Prinzipien, anstatt sich ausschließlich auf menschliches Feedback zu verlassen. Das Modell wird zunächst über RLHF (Reinforcement Learning from Human Feedback) trainiert, dann aber mithilfe eines „konstitutionellen“ Prozesses verfeinert, bei dem das Modell seine eigenen Ausgaben basierend auf einer Liste von Prinzipien kritisiert und überarbeitet. Diese Methode zielt darauf ab, Modelle hilfreicher, harmloser und ehrlicher zu machen und gleichzeitig den Trainingsprozess skalierbarer und transparenter zu gestalten.
Die Sicherheitsforschung des Unternehmens umfasst auch Arbeiten zur Interpretierbarkeit, etwa zum Verständnis, wie neuronale Netze Konzepte intern repräsentieren. Anthropic hat Arbeiten zu Themen wie „Schaltkreisen“ in Transformatoren veröffentlicht, die versuchen, die von diesen Modellen durchgeführten Berechnungen zu rekonstruieren. Diese Forschung ist Teil einer breiteren Anstrengung, sicherzustellen, dass KI-Systeme geprüft und vertraut werden können, insbesondere da sie immer leistungsfähiger werden.
Claude-Modellreihe
Die Hauptproduktlinie von Anthropic ist die Claude-Serie großer Sprachmodelle. Die erste Version, Claude, wurde im März 2023 veröffentlicht, gefolgt von Claude 2 im Juli 2023, das verbesserte Leistung und einen längeren Kontextfenster bot. Im März 2024 veröffentlichte Anthropic Claude 3, eine Familie von Modellen, darunter Haiku, Sonnet und Opus, die jeweils für unterschiedliche Geschwindigkeits- und Fähigkeitsabwägungen optimiert sind. Claude 3 Opus wurde für seine starke Leistung bei Benchmarks wie dem MMLU-Test hervorgehoben und übertraf oft Modelle anderer führender Labore.
Im Juni 2024 führte Anthropic Claude 3.5 Sonnet ein, das die Denk- und Programmierfähigkeiten weiter verbesserte. Die Modelle sind über eine API, einen Verbraucher-Chatbot unter claude.ai und Unternehmensangebote verfügbar. Claude-Modelle sind bekannt für ihre starke Leistung beim Programmieren, Verständnis langer Kontexte und Einhaltung von Sicherheitsrichtlinien. Sie werden von Unternehmen in verschiedenen Sektoren eingesetzt, darunter Finanzen, Gesundheitswesen und Rechtsdienstleistungen, für Aufgaben wie Dokumentenanalyse, Codegenerierung und Kundensupport.
Geschäftsmodell und Partnerschaften
Anthropic betreibt ein kommerzielles Geschäftsmodell und generiert Einnahmen durch API-Zugriff auf seine Modelle und Abonnementdienste. Das Unternehmen bietet eine kostenlose Stufe für seinen Chatbot sowie kostenpflichtige Pläne für Einzelpersonen und Unternehmen an. Seine wichtigsten Partnerschaften mit Cloud-Anbietern sind entscheidend für seinen Betrieb. Die AWS-Partnerschaft, die im September 2023 angekündigt wurde, umfasste eine Investition von 4 Milliarden US-Dollar, wobei AWS zum primären Trainings- und Bereitstellungspartner wurde. Diese Vereinbarung machte Claude-Modelle auch auf Amazon Bedrock, dem verwalteten KI-Dienst von AWS, verfügbar. Ähnlich umfasste die Google-Cloud-Partnerschaft, die im Februar 2023 angekündigt wurde, eine Investition von 300 Millionen US-Dollar, wobei Google Cloud Infrastruktur bereitstellte und die Vereinbarung später erweiterte.
Diese Partnerschaften haben es Anthropic ermöglicht, seine Operationen schnell zu skalieren, werfen jedoch auch Fragen zur Unabhängigkeit des Unternehmens auf, da es für Finanzierung und Rechenleistung auf große Technologieunternehmen angewiesen ist. Bis 2024 hat Anthropic insgesamt über 7 Milliarden US-Dollar an Finanzierung aufgebracht, mit einer Bewertung von etwa 18 Milliarden US-Dollar nach der Amazon-Investition.
Governance und Interessenvertretung für KI-Sicherheit
Anthropic hat sich als führend in der Interessenvertretung für KI-Sicherheit positioniert und verfolgt oft einen vorsichtigeren Ansatz bei der Modellbereitstellung als einige Wettbewerber. Das Unternehmen war in politische Diskussionen involviert, einschließlich Aussagen vor dem US-Kongress und Teilnahme an Brancheninitiativen. 2023 war Anthropic Mitbegründer des Frontier Model Forum, einer Gruppe, der auch OpenAI, Google und Microsoft angehören, die darauf abzielt, die sichere und verantwortungsvolle Entwicklung von Frontier-KI-Modellen zu fördern.
Das Unternehmen hat sich auch lautstark zu den potenziellen Risiken fortgeschrittener KI geäußert, einschließlich existenzieller Risiken, und hat sich für Regulierung und Transparenz eingesetzt. Seine „Responsible Scaling Policy“ skizziert einen Rahmen zur Bewertung und Minderung von Risiken, die mit zunehmend leistungsfähigeren Modellen verbunden sind, mit spezifischen Schwellenwerten für „AI Safety Level“ (ASL). Diese Richtlinie soll sicherstellen, dass angemessene Sicherheitsvorkehrungen vorhanden sind, wenn Modelle leistungsfähiger werden.
Forschungsbeiträge und Open Source
Obwohl Anthropic seine Modelle nicht als Open Source veröffentlicht hat, hat es durch Publikationen und Werkzeuge zur breiteren KI-Forschungsgemeinschaft beigetragen. Das Unternehmen hat Forschung zu Themen wie Aufmerksamkeitsmechanismen, Modellbereinigung und Interpretierbarkeit veröffentlicht. Es hat auch Datensätze und Evaluierungsbenchmarks veröffentlicht, wie den „Helpful, Honest, Harmless“ (HHH)-Datensatz, der zum Trainieren und Bewerten von Modellen in diesen Dimensionen verwendet wird.
Die Forschung von Anthropic zur Interpretierbarkeit war besonders einflussreich. 2022 veröffentlichte das Unternehmen eine Arbeit über „Toy Models of Superposition“, die untersuchte, wie neuronale Netze mehr Merkmale repräsentieren, als sie Dimensionen haben. 2023 veröffentlichte es eine Arbeit über „Extracting Interpretable Features from Claude 3 Sonnet“, die Techniken demonstrierte, um interne Merkmale im Zusammenhang mit Konzepten wie Täuschung und Schmeichelei zu identifizieren und zu manipulieren. Diese Bemühungen sind Teil eines langfristigen Ziels, KI-Systeme verständlicher und kontrollierbarer zu machen.
Wettbewerbslandschaft und Zukunftsaussichten
Anthropic operiert in einem stark wettbewerbsintensiven Umfeld mit großen Rivalen wie OpenAI, Google DeepMind und Meta AI. Das Unternehmen differenziert sich durch seinen Schwerpunkt auf Sicherheit und seinen Constitutional-AI-Ansatz. Es steht jedoch vor Herausforderungen, mit den schnellen Veröffentlichungszyklen der Wettbewerber Schritt zu halten und die hohen Kosten für das Training großer Modelle zu bewältigen. Bis 2024 expandiert Anthropic weiterhin sein Produktangebot, einschließlich der Veröffentlichung einer Claude-Mobil-App und unternehmensorientierter Funktionen wie „Projects“ und „Artifacts“ für kollaboratives Arbeiten.
Die zukünftige Richtung von Anthropic wird wahrscheinlich die fortgesetzte Skalierung seiner Modelle, eine tiefere Integration in Unternehmensworkflows und weitere Fortschritte in der Interpretierbarkeit umfassen. Das Engagement des Unternehmens für Sicherheit könnte auch zu neuen Governance-Rahmenwerken führen, die die breitere Branche beeinflussen könnten. Während sich die KI-Technologie weiterentwickelt, wird die Rolle von Anthropic als sicherheitsorientierter Innovator von Forschern, politischen Entscheidungsträgern und Branchenbeobachtern gleichermaßen genau beobachtet werden.
Siehe auch
Referenzen
Dieser Artikel basiert auf öffentlich verfügbaren Informationen bis 2024. Für die aktuellsten Details siehe die offiziellen Mitteilungen von Anthropic und seriöse Technologienachrichtenquellen.