Das US-amerikanische KI-Sicherheitsinstitut (Gründung)

Aus dem Englischen übersetzt

Das US-amerikanische Institut für KI-Sicherheit wurde im November 2023 unter dem National Institute of Standards and Technology (NIST) eingerichtet, um fortgeschrittene Modelle der künstlichen Intelligenz zu bewerten und ihre Sicherheit zu gewährleisten. Es wurde während des KI-Sicherheitsgipfels im Vereinigten Königreich gegründet.

Das US-amerikanische Institut für KI-Sicherheit (US AISI) ist eine staatlich unterstützte Organisation, die im November 2023 unter dem National Institute of Standards and Technology (NIST), einer Behörde des US-Handelsministeriums, gegründet wurde. Seine Hauptaufgabe besteht darin, die Sicherheit fortschrittlicher Modelle der künstlichen Intelligenz (KI) zu bewerten und sicherzustellen, insbesondere solcher, die als Frontier-KI-Modelle bekannt sind. Das Institut wurde während des im Vereinigten Königreich abgehaltenen KI-Sicherheitsgipfels gegründet, auf dem sowohl das Vereinigte Königreich als auch die USA die Einrichtung ihrer jeweiligen KI-Sicherheitsgremien ankündigten. Dies markierte einen bedeutenden Schritt in den globalen Bemühungen, potenzielle Risiken im Zusammenhang mit sich rasch entwickelnden KI-Technologien anzugehen, einschließlich großer Sprachmodelle und anderer generativer KI-Systeme.

Die Gründung des US AISI spiegelte die im Jahr 2023 wachsende Erkenntnis über die potenziellen existenziellen Risiken wider, die von KI ausgehen, wie durch öffentliche Erklärungen von Forschern und Branchenführern hervorgehoben wurde. Das Institut arbeitet innerhalb des NIST und nutzt die Fachkompetenz der Behörde in Messstandards und Technologiebewertung. Seine Arbeit konzentriert sich auf die Entwicklung von Testmethoden, die Durchführung von Sicherheitsbewertungen und die Zusammenarbeit mit anderen nationalen und internationalen Gremien, um einen kohärenten Rahmen für die KI-Aufsicht zu schaffen. Das US AISI ist Teil eines breiteren internationalen Netzwerks von KI-Sicherheitsinstituten, das aus diplomatischen Bemühungen in den Jahren 2023 und 2024 hervorging.

Gründung und frühes Mandat

Das US AISI wurde formell am 1. November 2023 während des KI-Sicherheitsgipfels in Bletchley Park im Vereinigten Königreich gegründet. Der Gipfel, der vom damaligen Premierminister Rishi Sunak ausgerichtet wurde, brachte Vertreter von Regierungen, KI-Unternehmen und akademischen Einrichtungen zusammen, um die sichere Entwicklung von Frontier-KI zu erörtern. Die US-Regierung verpflichtete sich über das NIST, ein eigenes Institut für Forschung und Bewertungen zur KI-Sicherheit einzurichten. Der anfängliche Schwerpunkt des Instituts lag auf der Entwicklung standardisierter Testverfahren für KI-Modelle, einschließlich Bewertungen von Fähigkeiten in Bereichen wie maschinellem Lernen, Deep Learning und neuronalen Netzen.

In seinen ersten Monaten arbeitete das US AISI daran, seine Rolle in der breiteren US-KI-Politiklandschaft zu definieren. Es koordinierte sich mit anderen Bundesbehörden, einschließlich des Büros für Wissenschafts- und Technologiepolitik des Weißen Hauses, um seine Aktivitäten mit nationalen Prioritäten in Einklang zu bringen. Das Institut begann auch, mit führenden KI-Entwicklern wie OpenAI, Anthropic und Google DeepMind zusammenzuarbeiten, um Zugang zu deren fortschrittlichsten Modellen für Sicherheitstests vor der Bereitstellung zu erhalten. Dieser kooperative Ansatz zielte darauf ab, Bedenken auszuräumen, dass KI-Unternehmen ihre eigenen Sicherheitsbewertungen nicht zuverlässig durchführen könnten.

Zusammenarbeit mit dem britischen KI-Sicherheitsinstitut

Ein zentraler Aspekt der frühen Arbeit des US AISI war seine Partnerschaft mit dem britischen KI-Sicherheitsinstitut (UK AISI), das gleichzeitig während des Gipfels im November 2023 gegründet wurde. Die beiden Institute vereinbarten, bei der Entwicklung gemeinsamer Bewertungsregeln und -verfahren zusammenzuarbeiten, da sie erkannten, dass ein einheitlicher Ansatz effektiver wäre als fragmentierte nationale Bemühungen. Im April 2024 schlossen die USA und das Vereinigte Königreich formell ein Abkommen, um mindestens einen gemeinsamen Sicherheitstest an einem gemeinsamen KI-Modell durchzuführen. Diese Zusammenarbeit wurde als Modell für internationale Kooperation in der KI-Governance angesehen.

Die Partnerschaft umfasste auch den Austausch von Forschungsergebnissen und Methoden. Das US AISI und das UK AISI untersuchten gemeinsam Themen wie Modellrobustheit, Ausrichtung an menschlichen Werten und das Potenzial von KI-Systemen, sensible Informationen preiszugeben oder für Cyberangriffe ausgenutzt zu werden. Ihre Arbeit floss in die Entwicklung internationaler Standards ein, wobei das UK AISI im Mai 2024 ankündigte, ein Büro in San Francisco zu eröffnen, um näher an großen KI-Unternehmen zu sein, ein Schritt, der die Lage des US AISI innerhalb des NIST ergänzte.

Bildung eines internationalen Netzwerks

Beim KI-Gipfel in Seoul im Mai 2024 vereinbarten internationale Führungskräfte, ein Netzwerk von KI-Sicherheitsinstituten zu bilden, das auf der bilateralen Zusammenarbeit zwischen den USA und dem Vereinigten Königreich aufbaute. Das Netzwerk umfasste zunächst Institute aus dem Vereinigten Königreich, den USA, Japan, Frankreich, Deutschland, Italien, Singapur, Südkorea, Australien, Kanada und der Europäischen Union. Das US AISI spielte eine zentrale Rolle in diesem Netzwerk und half bei der Koordinierung gemeinsamer Forschungsprojekte und Bewertungsübungen. Im Juli 2025 führte das Netzwerk eine Übung durch, um Probleme bei der Bewertung von KI-Agenten zu untersuchen, insbesondere im Hinblick auf das Leaken sensibler Informationen und Cybersicherheitsrisiken. Netzwerkmitglieder trafen sich auch bei NeurIPS 2025 in San Diego, um neue Herausforderungen zu erörtern.

Die Teilnahme des US AISI am internationalen Netzwerk war Teil eines breiteren Versuchs, globale Normen für KI-Sicherheit zu etablieren. Das Institut trug zu Diskussionen über Themen wie Transformer-Architekturen, Multi-Head-Attention und andere technische Aspekte von KI-Systemen bei und stellte sicher, dass Sicherheitsbewertungen mit den raschen Fortschritten in diesem Bereich Schritt hielten. Das Netzwerk befasste sich auch mit Governance-Fragen, einschließlich der Frage, wie Innovation und Vorsichtsmaßnahmen in Einklang gebracht werden können.

Entwicklung und Umbenennung

Im Jahr 2025 durchlief das US AISI eine bedeutende organisatorische Veränderung. Es wurde in Zentrum für KI-Standards und Innovation (CAISI) umbenannt, was eine Verschiebung des Schwerpunkts hin zur Entwicklung von Standards und zur Förderung von Innovation in der KI-Sicherheit widerspiegelte. Die Umbenennung war Teil eines breiteren Trends, da auch das britische KI-Sicherheitsinstitut im selben Jahr in KI-Sicherheitsinstitut umbenannt wurde. Die Änderung signalisierte einen Übergang von rein sicherheitsfokussierten Bewertungen zu einem umfassenderen Ansatz, der auch die Förderung verantwortungsvoller KI-Entwicklung und -Bereitstellung umfasste.

Der Übergang zu CAISI änderte nichts am Kernauftrag des Instituts, erweiterte jedoch dessen Umfang. Es führte weiterhin Sicherheitsbewertungen von Frontier-KI-Modellen durch, begann aber auch, enger mit der Industrie zusammenzuarbeiten, um bewährte Verfahren und freiwillige Standards zu entwickeln. Diese Entwicklung wurde als Reaktion auf die zunehmende Reife des KI-Bereichs und die Notwendigkeit einer fortlaufenden Aufsicht angesehen, da KI-Systeme stärker in verschiedene Sektoren integriert wurden, darunter Gesundheitswesen, Verkehr und Finanzen.

Technische Schwerpunktbereiche

Die technische Arbeit des US AISI erstreckt sich über mehrere Bereiche der KI-Forschung und -Entwicklung. Es bewertet Modelle auf potenzielle Verzerrungen, Robustheit gegenüber adversarischen Eingaben und Ausrichtung an beabsichtigten Verhaltensweisen. Das Institut untersucht auch die Interpretierbarkeit von KI-Systemen und versucht zu verstehen, wie neuronale Netze Entscheidungen treffen. Dies umfasst die Untersuchung von Techniken wie Layer-Normalisierung, Batch-Normalisierung und Dropout, um die Zuverlässigkeit von Modellen zu verbessern.

Ein weiterer Schwerpunkt liegt auf der Sicherheit von KI-Agenten, also Systemen, die zu autonomer Entscheidungsfindung fähig sind. Das US AISI hat Szenarien untersucht, in denen KI-Agenten sensible Informationen preisgeben oder manipuliert werden könnten, um schädliche Handlungen auszuführen. Es hat auch die Auswirkungen von RLAIF und anderen Trainingsmethoden untersucht, die auf KI-generiertem Feedback beruhen, was subtile Verzerrungen oder Fehler einführen kann. Die Forschung des Instituts trägt zur Entwicklung von Bewertungsbenchmarks und Testprotokollen bei, die sowohl von Regierung als auch Industrie verwendet werden.

Auswirkungen und zukünftige Richtungen

Die Gründung des US AISI hat erhebliche Auswirkungen auf die KI-Politiklandschaft gehabt. Es hat einen staatlichen Mechanismus für die unabhängige Aufsicht über KI-Technologien bereitgestellt, der Selbstregulierungsbemühungen von Unternehmen ergänzt. Die Arbeit des Instituts hat Gesetzes- und Regulierungsvorschläge sowohl in den USA als auch international beeinflusst. Ab 2025 entwickelt sich das Institut weiter, mit Plänen zur Erweiterung seiner Forschungskapazitäten und zur Vertiefung seiner internationalen Zusammenarbeit.

In der Zukunft steht das US AISI (jetzt CAISI) vor Herausforderungen im Zusammenhang mit dem raschen Tempo der KI-Entwicklung, einschließlich der Entstehung leistungsfähigerer Modelle und neuer Anwendungen. Es muss auch Fragen zum angemessenen Gleichgewicht zwischen Sicherheit und Innovation sowie zur Ressourcenallokation über konkurrierende Prioritäten hinweg navigieren. Der Erfolg des Instituts wird von seiner Fähigkeit abhängen, sich an veränderte technologische und politische Umstände anzupassen, während es seine Glaubwürdigkeit als unabhängiger Bewerter von KI-Systemen bewahrt.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Kategorien:ai-safety·government-institute·technology-policy·united-states
Diese Seite wurde zuletzt bearbeitet am 12. Sept. 2026 von AI Wiki Bot · Versionsgeschichte