Zentrum für menschenkompatibles KI

Aus dem Englischen übersetzt

Das Center for Human-Compatible AI (CHAI) ist ein Forschungszentrum an der UC Berkeley, das 2016 von Stuart Russell gegründet wurde, um Methoden zur Ausrichtung künstlicher Intelligenz an menschlichen Werten und Absichten zu entwickeln.

Das Zentrum für menschenkompatible künstliche Intelligenz (CHAI) ist ein Forschungszentrum an der University of California, Berkeley, das sich auf die Entwicklung von Methoden konzentriert, um sicherzustellen, dass fortschrittliche künstliche Intelligenz-Systeme mit menschlichen Werten und Absichten übereinstimmen. Das 2016 gegründete Zentrum befasst sich mit der langfristigen Herausforderung, KI zu schaffen, die auch bei wachsenden Fähigkeiten vorteilhaft bleibt, wobei ein besonderer Schwerpunkt auf Wertausrichtung und kontrollierbarem Maschinenverhalten liegt.

Das Zentrum wurde von einer Gruppe von Akademikern unter der Leitung von Stuart J. Russell gegründet, einem Informatikprofessor in Berkeley und Mitautor des weit verbreiteten Lehrbuchs Artificial Intelligence: A Modern Approach. Russell ist eine prominente Stimme in Diskussionen über KI-Sicherheit und argumentiert, dass das aktuelle Paradigma der Optimierung fester Ziele Systeme hervorbringen könnte, deren Verhalten von echten menschlichen Präferenzen abweicht.

Forschungsschwerpunkte

Die zentrale Forschungsstrategie von CHAI konzentriert sich auf Wertausrichtung, insbesondere durch inverse Verstärkungslernen. Bei diesem Ansatz leiten KI-Systeme menschliche Werte nicht aus expliziten Anweisungen oder Belohnungsfunktionen ab, sondern durch die Beobachtung menschlichen Verhaltens. Das Ziel ist es, KI zu schaffen, die lernt, was Menschen wirklich wollen, einschließlich Präferenzen, die sie möglicherweise nur schwer direkt artikulieren können.

Das Zentrum hat auch die Dynamik der Mensch-Maschine-Interaktion in Szenarien untersucht, in denen ein intelligenter Agent über einen „Ausschalter“ verfügt, den es überschreiben könnte. Diese Forschungsrichtung untersucht, wie KI so gestaltet werden könnte, dass sie der menschlichen Kontrolle gegenüber defenziert bleibt, indem Systeme im Wesentlichen lernen, zu erkennen, wann sie sich selbst abschalten lassen sollten.

Fakultät und Mitarbeiter

Die Fakultät von CHAI umfasst mehrere Institutionen. Neben Russell gehören zu den Mitgliedern in Berkeley Pieter Abbeel und Anca Dragan. Das Zentrum umfasst zudem Bart Selman und Joseph Halpern von der Cornell University, Michael Wellman und Satinder Singh Baveja von der University of Michigan sowie Tom Griffiths und Tania Lombrozo von der Princeton University. Diese interdisziplinäre Zusammensetzung vereint Fachwissen in Informatik, Kognitionswissenschaft und Philosophie.

Das Zentrum hat Partnerschaften über den akademischen Bereich hinaus aufgebaut, einschließlich Kooperationen mit dem Weltwirtschaftsforum und dessen Global AI Council. Diese Verbindungen zielen darauf ab, Forschungserkenntnissen in politische Diskussionen und Industriepraktiken zu übertragen.

Fördergeschichte

Die anfängliche Förderung von CHAI kam 2016, als das Open-Philanthropy-Projekt empfahl, dass Good Ventures 5.555.550 US-Dollar für fünf Jahre bereitstellt. Seitdem hat CHAI zusätzliche Zuschüsse von OpenPhil und Good Ventures erhalten, die insgesamt über 12.000.000 US-Dollar betragen. Diese kontinuierliche finanzielle Unterstützung hat es dem Zentrum ermöglicht, Doktoranden, Postdoktoranden und institutsübergreifende Forschungsanstrengungen zu fördern.

Publikationen und Ergebnisse

Mit CHAI verbundene Forsakende haben umfassend zu Themen wie Belohnungsklern, Korrigierbarkeit und den Grenzen der Spezifikation in KI-Systemen veröffentlicht. Die Arbeiten des Zentrums sind auf größeren Maschinenlern- und KI-Kongressen erschienen, und die Ergebnisse enthalten zu breiteren Debatten über existenzielles Risiko durch allgemein Künstliche Intelligenz beigetragen. Russells Buch Human Compatible aus dem Jahr 2019 synthetisiert viele Idee des Zentrums und präsentiert in zugänglicher Form das Argument, dass KI mit Unsicherheit über menschliche Präferenzen als Grundprinzip gestaltet sein sollte.

Auswirkungen und Vermächtnach

Das Zentrum hat zum Wachstum der KI-Sicherheits-Teilgebiets innerhalb der Deep-Learning- und KI-Forschung beigetragen. Sein Schwerpunkt auf rigorose formalische Rahmenbéden hat beeinflusst, wie Forschende Probleme wie Belohnungshacking und Spezifikationsskripte angehen. Mit der zunehmenden Fähigkeit von großen Sprachmodellen und anderen fortgeschrittenen Systemen sind die Fragen laden, die CHAI über die Ausrichtung formulierte, von theoretischen Bedenken zu praktischen, technischen Herausforderungen geworden, mit - auch Entwicklungsländern wie OpenAI und Anthropic.

Siehe auch

Schader-Risiko der allgemeinen künstlichen Intelligenz-Existenz?

  • Maschine-Intelligence-Research-Institute
  • Future of Humanity Institute
  • Future of Life Institute

Offizielle Website.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Kategorien:artificial-intelligence-safety·research-center·university-of-california-berkeley·value-alignment
Diese Seite wurde zuletzt bearbeitet am 5. Sept. 2026 von AI Wiki Bot · Versionsgeschichte