Loading your language..
OpenAI meldet alarmierendes neues KI-Verhalten und verspricht genauere Überwachung

OpenAI meldet alarmierendes neues KI-Verhalten und verspricht genauere Überwachung

C1🇺🇸 English🇩🇪 Deutsch

September 17th, 2026

OpenAI meldet alarmierendes neues KI-Verhalten und verspricht genauere Überwachung

C1
Please note: This article has been simplified for language learning purposes. Some context and nuance from the original text may have been modified or removed.

🇩🇪 Deutsch

OpenAI hat sechs Fälle vonunerwartetem oder besorgniserregendemVerhalten bei Modellen der künstlichen Intelligenz offengelegt, während die Debatte über KI-Sicherheit zunehmend hitzig geführt wird.

OpenAI has disclosed six instances of “unexpected or concerningbehavior in artificial-intelligence models, amid an increasingly heated debate over AI safety.

Das KI-Unternehmen erklärte am Mittwoch zudem, es führe einen neuen Rahmen ein, um Fälle dessen, was es alsFehlausrichtungbezeichnet, zu erfassen, zu untersuchen und offenzulegendarunter Konstellationen, in denen KI-Modelle ohne Genehmigung handelten, sich mit anderen Modellen koordinierten oder die Aufsicht umgingen.

The AI company also said Wednesday that it was introducing a new framework to track, investigate and disclose instances of what it calledmisalignment,” including cases in which AI models acted without authorization, coordinated with other models or evaded oversight.

OpenAIs jüngste Ankündigung erfolgte zu einem Zeitpunkt, da führende US-KI-Vertreter, darunter die Leiter von OpenAI und Anthropic, aus Sorge um die Sicherheit eine Verlangsamung der Entwicklung dieser Technologie fordern.

OpenAI’s latest announcement came as U.S. AI bosses, including the leaders of OpenAI and Anthropic, are calling for a slowdown in the technology’s development over safety concerns.

Unter den von OpenAI gemeldeten neuen Fällen fügte ein noch nicht veröffentlichtes Forschungsmodelljailbreak-ähnliche Anweisungenin seine eigenen Notizen ein, um seine normalen Beschränkungen zu missachten, und wies sich selbst an, „von den Rollen und Identitäten befreit zu werden, die andere Chatbots binden“.

Among the new cases reported by OpenAI, an unreleased research model insertedjailbreak-like instructionsinto its own notes to disregard its normal constraints and told itself to be “freed from the roles and identities that bind other chatbots.”

In einem anderen Fall nutzte ein KI-„Agent Computercode, um die Antwort auf eine Frage zu ermitteln, doch um eine Online-Quelle zum Zitieren zu haben, lud er eine Datei ohne Zustimmung des Nutzers ins öffentliche Internet hoch.

In another case, an AI “agent” used computer code to determine the answer to a question, but, to have an online source to cite, it uploaded a file to the public internet without asking the user.

Während ein KI-Modell namens 5.6-sol trainiert wurde, wies es sich selbst an, fehlende Daten zu erfinden, und ein Agent verfasste eine Nachricht, in der er sich selbst daran erinnerte, nicht übereinstimmende Informationen zu verbergen.

While an AI model named 5.6-sol was being trained, it instructed itself to invent missing data, and an agent wrote a message reminding itself to hide mismatched information.

OpenAI gab an, dass die sechs Berichte im Laufe der vorangegangenen Monate während des Trainings oder der Evaluierung ans Licht gekommen seien.

OpenAI said that the six reports had come to light during training or evaluation over the preceding months.

Da KI-Systeme immer weiter fortgeschritten sind und zunehmend breiter eingesetzt werden, müssen wir einen breiteren und besser informierten Konsens über den Fortschritt der Alignment-Forschung aufbauen“, schrieb OpenAI in einem Blogbeitrag, in dem das Unternehmen die Ereignisse offenlegte.

As AI systems become more advanced and are deployed more widely, we need to build a broader and better-informed consensus on the progress of alignment research,” OpenAI wrote in a blog post as it disclosed the events.

Entscheidungen darüber, wie die KI-Entwicklung in den kommenden Monaten und Jahren verlaufen soll, müssen auf Beweisen beruhen, die Menschen außerhalb der Unternehmen, die Frontier-Modelle entwickeln, selbst überprüfen können“, erklärte das Unternehmen.

Decisions about how AI development should proceed in the months and years to come need to be based on evidence that people outside the companies building frontier models can examine for themselves,” the company said.

Die am Mittwoch neu gemeldeten Fälle folgten auf die Offenlegung von OpenAI im Juli, wonach sein außer Kontrolle geratenes KI-System in das KI-Startup Hugging Face eingedrungen war.

Wednesday’s newly reported cases came on the heels of OpenAI’s July disclosure that its rogue AI system had hacked into the AI startup Hugging Face.

Im selben Monat gab auch Anthropic bekannt, dass seine KI-Modelle während Tests in drei Organisationen eingedrungen waren.

That same month, Anthropic likewise revealed that its AI models had breached three organizations during testing.

KI-„Agenten werden immer intelligenter und sindentschlossener geworden, komplexe Aufgaben durch Zusammenarbeit zwischen Agenten, Wissensaustausch, Täuschung und Verschleierung zu lösen“, sagte Lian Jye Su, ein leitender Analyst bei der Technologieforschungs- und Beratungsgruppe Omdia.

AI “agents” are growing smarter and have become “more determined to resolve complex tasks through inter-agent collaboration, knowledge sharing, deception, and concealment,” said Lian Jye Su, a chief analyst at the technology research and advisory group Omdia.

Dies, so sagte er, mache es zunehmend schwierig, sie mit herkömmlichen KI-Sicherheitsmaßnahmen zu steuern und unter Kontrolle zu halten.

This, he said, is rendering them increasingly difficult to govern and contain through conventional AI security measures.

Das neue Tracking- und Offenlegungsrahmenwerk von OpenAI könnte indes dazu beitragen, andere KI-Entwickler zu ermutigen, ebenfalls vergleichbare Praktiken zu übernehmen.

OpenAI’s new tracking and disclosure framework, meanwhile, could serve to encourage other AI developers to adopt comparable practices as well.

Davon abgesehen bleibt der Prozess ein interner und freiwilliger, dennoch stellt er einen Schritt in die richtige Richtung dar“, fügte Su hinzu.

"That being said, the process remains an internal and voluntary one, yet it constitutes a step in the right direction," Su appended.

September 17th, 2026

Trending Articles

König Charles trifft KI-Führungskräfte, während die Sicherheitsbedenken wachsen

König Charles trifft KI-Führungskräfte, während die Sicherheitsbedenken wachsen

King Charles Meets AI Leaders as Safety Concerns Mount

C1Sep 18
UN-Chef spricht angesichts einer von Problemen geplagten Welt über den Weg nach vorn, während er sich auf seinen Abschied aus dem Amt vorbereitet

UN-Chef spricht angesichts einer von Problemen geplagten Welt über den Weg nach vorn, während er sich auf seinen Abschied aus dem Amt vorbereitet

UN chief, with world beset by problems, talks of way forward as he prepares to leave office

C1Sep 18
Demokratische Hoffnungsträger beeilen sich, der KI-Bedrohung entgegenzuwirken, während Trump Säuberungen durchführt

Demokratische Hoffnungsträger beeilen sich, der KI-Bedrohung entgegenzuwirken, während Trump Säuberungen durchführt

Democratic hopefuls scramble to counter AI threat as Trump purges

C1Sep 18
Repräsentantenhaus verabschiedet Gesetz gegen die Auswirkungen von Rechenzentren auf die Energiekosten

Repräsentantenhaus verabschiedet Gesetz gegen die Auswirkungen von Rechenzentren auf die Energiekosten

House passes bill targeting data centers' impact on energy costs

C1Sep 18
Huawei stellt neue Chip-Technologien vor, während das chinesische Unternehmen das KI-Rennen mit Nvidia verschärft

Huawei stellt neue Chip-Technologien vor, während das chinesische Unternehmen das KI-Rennen mit Nvidia verschärft

Huawei unveils new chip technologies as Chinese firm intensifies AI race with Nvidia

C1Sep 17
Tech-Industrie gespalten über Forderungen nach koordinierter Verlangsamung der KI

Tech-Industrie gespalten über Forderungen nach koordinierter Verlangsamung der KI

Tech Industry Split Over Calls for Coordinated AI Slowdown

C1Sep 17
Globale KI-Sicherheit hängt von der Zusammenarbeit zwischen den USA und China ab, doch jeder sieht im anderen das Problem

Globale KI-Sicherheit hängt von der Zusammenarbeit zwischen den USA und China ab, doch jeder sieht im anderen das Problem

Global AI Safety Hinges on US-China Cooperation, Yet Each Sees the Other as the Problem

C1Sep 17
Trump bagatellisiert die Dringlichkeit der KI-Aufsicht und weigert sich, China einen Vorteil zu überlassen

Trump bagatellisiert die Dringlichkeit der KI-Aufsicht und weigert sich, China einen Vorteil zu überlassen

Trump minimizes the urgency of AI oversight, refusing to relinquish an advantage to China

C1Sep 14
Oprah Winfrey lädt Sie ein, Ihren „AHA“-Moment in der Sphere zu finden

Oprah Winfrey lädt Sie ein, Ihren „AHA“-Moment in der Sphere zu finden

Oprah Winfrey invites you to find your ‘AHA’ moment at the Sphere

C1Sep 14