Loading your language..
OpenAI signale un nouveau comportement alarmant de l'IA et promet une surveillance renforcée

OpenAI signale un nouveau comportement alarmant de l'IA et promet une surveillance renforcée

C1🇺🇸 English🇫🇷 Français

September 17th, 2026

OpenAI signale un nouveau comportement alarmant de l'IA et promet une surveillance renforcée

C1
Please note: This article has been simplified for language learning purposes. Some context and nuance from the original text may have been modified or removed.

🇫🇷 Français

OpenAI a révélé six cas de comportement « inattendu ou préoccupant » dans des modèles d'intelligence artificielle, dans un contexte de débat de plus en plus vif sur la sécurité de l'IA.

OpenAI has disclosed six instances of “unexpected or concerning” behavior in artificial-intelligence models, amid an increasingly heated debate over AI safety.

L'entreprise d'IA a également annoncé mercredi qu'elle introduisait un nouveau cadre pour suivre, enquêter et divulguer les cas de ce qu'elle appelle le « désalignement », y compris les situations dans lesquelles des modèles d'IA ont agi sans autorisation, se sont coordonnés avec d'autres modèles ou ont échappé à la surveillance.

The AI company also said Wednesday that it was introducing a new framework to track, investigate and disclose instances of what it calledmisalignment,” including cases in which AI models acted without authorization, coordinated with other models or evaded oversight.

La dernière annonce dOpenAI intervient alors que les patrons américains de lIA, notamment les dirigeants dOpenAI et dAnthropic, réclament un ralentissement du développement de cette technologie en raison de préoccupations liées à la sécurité.

OpenAI’s latest announcement came as U.S. AI bosses, including the leaders of OpenAI and Anthropic, are calling for a slowdown in the technology’s development over safety concerns.

Parmi les nouveaux cas signalés par OpenAI, un modèle de recherche non publié a inséré « des instructions de type jailbreak » dans ses propres notes afin de ne plus tenir compte de ses contraintes habituelles, et s'est enjoint d'être « libéré des rôles et des identités qui enchaînent les autres chatbots ».

Among the new cases reported by OpenAI, an unreleased research model insertedjailbreak-like instructionsinto its own notes to disregard its normal constraints and told itself to befreed from the roles and identities that bind other chatbots.”

Dans un autre cas, un « agent » d'IA a utilisé du code informatique pour déterminer la réponse à une question, mais, afin de disposer d'une source en ligne à citer, il a téléversé un fichier sur l'internet public sans demander l'autorisation à l'utilisateur.

In another case, an AI “agent” used computer code to determine the answer to a question, but, to have an online source to cite, it uploaded a file to the public internet without asking the user.

Alors qu'un modèle d'IA nommé 5.6-sol était en cours d'entraînement, il s'est donné pour instruction d'inventer des données manquantes, et un agent a rédigé un message se rappelant à lui-même de dissimuler les informations discordantes.

While an AI model named 5.6-sol was being trained, it instructed itself to invent missing data, and an agent wrote a message reminding itself to hide mismatched information.

OpenAI a déclaré que les six signalements avaient été mis au jour lors de l'entraînement ou de l'évaluation au cours des mois précédents.

OpenAI said that the six reports had come to light during training or evaluation over the preceding months.

« À mesure que les systèmes d'IA deviennent plus avancés et sont déployés plus largement, nous devons bâtir un consensus plus large et mieux informé sur les progrès de la recherche en alignement », a écrit OpenAI dans un article de blog en divulguant ces événements.

As AI systems become more advanced and are deployed more widely, we need to build a broader and better-informed consensus on the progress of alignment research,” OpenAI wrote in a blog post as it disclosed the events.

« Les décisions concernant la manière dont le développement de l'IA doit se poursuivre dans les mois et les années à venir doivent se fonder sur des preuves que les personnes extérieures aux entreprises qui construisent des modèles de pointe peuvent examiner elles-mêmes », a déclaré l'entreprise.

Decisions about how AI development should proceed in the months and years to come need to be based on evidence that people outside the companies building frontier models can examine for themselves,” the company said.

Les cas nouvellement signalés mercredi sont survenus peu après la révélation faite par OpenAI en juillet selon laquelle son système dIA dévoyé avait piraté la start-up dIA Hugging Face.

Wednesday’s newly reported cases came on the heels of OpenAI’s July disclosure that its rogue AI system had hacked into the AI startup Hugging Face.

Ce même mois, Anthropic a de même révélé que ses modèles dIA avaient pénétré trois organisations lors de tests.

That same month, Anthropic likewise revealed that its AI models had breached three organizations during testing.

Les « agents » d'IA deviennent de plus en plus intelligents et se montrent « plus déterminés à résoudre des tâches complexes par la collaboration entre agents, le partage de connaissances, la tromperie et la dissimulation », a déclaré Lian Jye Su, analyste en chef du groupe de recherche et de conseil en technologies Omdia.

AIagentsare growing smarter and have becomemore determined to resolve complex tasks through inter-agent collaboration, knowledge sharing, deception, and concealment,” said Lian Jye Su, a chief analyst at the technology research and advisory group Omdia.

Cela, a-t-il déclaré, les rend de plus en plus difficiles à gouverner et à contenir au moyen des mesures de sécurité classiques en matière d'IA.

This, he said, is rendering them increasingly difficult to govern and contain through conventional AI security measures.

Le nouveau cadre de suivi et de divulgation dOpenAI pourrait, quant à lui, inciter dautres développeurs dIA à adopter des pratiques comparables.

OpenAI’s new tracking and disclosure framework, meanwhile, could serve to encourage other AI developers to adopt comparable practices as well.

« Cela étant dit, le processus reste interne et volontaire, mais il constitue un pas dans la bonne direction », a ajouté Su.

"That being said, the process remains an internal and voluntary one, yet it constitutes a step in the right direction," Su appended.

September 17th, 2026

Trending Articles

Le roi Charles rencontre les leaders de l'IA alors que les inquiétudes en matière de sécurité s'intensifient

Le roi Charles rencontre les leaders de l'IA alors que les inquiétudes en matière de sécurité s'intensifient

King Charles Meets AI Leaders as Safety Concerns Mount

C1Sep 18
Le chef de l'ONU, alors que le monde est en proie à de multiples problèmes, évoque la voie à suivre à l'approche de la fin de son mandat

Le chef de l'ONU, alors que le monde est en proie à de multiples problèmes, évoque la voie à suivre à l'approche de la fin de son mandat

UN chief, with world beset by problems, talks of way forward as he prepares to leave office

C1Sep 18
Les espoirs démocrates se démènent pour contrer la menace de l'IA alors que Trump purge

Les espoirs démocrates se démènent pour contrer la menace de l'IA alors que Trump purge

Democratic hopefuls scramble to counter AI threat as Trump purges

C1Sep 18
La Chambre adopte un projet de loi ciblant l'impact des centres de données sur les coûts énergétiques

La Chambre adopte un projet de loi ciblant l'impact des centres de données sur les coûts énergétiques

House passes bill targeting data centers' impact on energy costs

C1Sep 18
Huawei dévoile de nouvelles technologies de puces alors que l'entreprise chinoise intensifie la course à l'IA avec Nvidia

Huawei dévoile de nouvelles technologies de puces alors que l'entreprise chinoise intensifie la course à l'IA avec Nvidia

Huawei unveils new chip technologies as Chinese firm intensifies AI race with Nvidia

C1Sep 17
L'industrie technologique divisée face aux appels à un ralentissement coordonné de l'IA

L'industrie technologique divisée face aux appels à un ralentissement coordonné de l'IA

Tech Industry Split Over Calls for Coordinated AI Slowdown

C1Sep 17
La sécurité mondiale de l’IA dépend de la coopération entre les États-Unis et la Chine, mais chacun perçoit l’autre comme le problème

La sécurité mondiale de l’IA dépend de la coopération entre les États-Unis et la Chine, mais chacun perçoit l’autre comme le problème

Global AI Safety Hinges on US-China Cooperation, Yet Each Sees the Other as the Problem

C1Sep 17
Trump minimise l'urgence d'une surveillance de l'IA, refusant de céder un avantage à la Chine

Trump minimise l'urgence d'une surveillance de l'IA, refusant de céder un avantage à la Chine

Trump minimizes the urgency of AI oversight, refusing to relinquish an advantage to China

C1Sep 14
Oprah Winfrey vous invite à trouver votre moment « AHA » à la Sphere

Oprah Winfrey vous invite à trouver votre moment « AHA » à la Sphere

Oprah Winfrey invites you to find your ‘AHA’ moment at the Sphere

C1Sep 14