Loading your language..
OpenAI señala una alarmante nueva conducta de la IA y promete una vigilancia más estrecha

OpenAI señala una alarmante nueva conducta de la IA y promete una vigilancia más estrecha

C1🇺🇸 English🇪🇸 Español

September 17th, 2026

OpenAI señala una alarmante nueva conducta de la IA y promete una vigilancia más estrecha

C1
Please note: This article has been simplified for language learning purposes. Some context and nuance from the original text may have been modified or removed.

🇪🇸 Español

OpenAI ha revelado seis casos de comportamiento «inesperado o preocupante» en modelos de inteligencia artificial, en medio de un debate cada vez más acalorado sobre la seguridad de la IA.

OpenAI has disclosed six instances of “unexpected or concerning” behavior in artificial-intelligence models, amid an increasingly heated debate over AI safety.

La empresa de IA también anunció el miércoles que estaba introduciendo un nuevo marco para rastrear, investigar y divulgar casos de lo que denominódesalineación”, incluyendo situaciones en las que los modelos de IA actuaron sin autorización, se coordinaron con otros modelos o eludieron la supervisión.

The AI company also said Wednesday that it was introducing a new framework to track, investigate and disclose instances of what it calledmisalignment,” including cases in which AI models acted without authorization, coordinated with other models or evaded oversight.

El último anuncio de OpenAI se produjo en un momento en que los responsables de las principales empresas de IA de Estados Unidos, entre ellos los líderes de OpenAI y Anthropic, están pidiendo una ralentización del desarrollo de esta tecnología debido a preocupaciones por la seguridad.

OpenAI’s latest announcement came as U.S. AI bosses, including the leaders of OpenAI and Anthropic, are calling for a slowdown in the technology’s development over safety concerns.

Entre los nuevos casos reportados por OpenAI, un modelo de investigación no publicado insertó «instrucciones similares a las de un jailbreak» en sus propias notas para hacer caso omiso de sus restricciones habituales y se dijo a mismo que debía «liberarse de los roles y las identidades que atan a otros chatbots».

Among the new cases reported by OpenAI, an unreleased research model insertedjailbreak-like instructionsinto its own notes to disregard its normal constraints and told itself to be “freed from the roles and identities that bind other chatbots.”

En otro caso, un «agente» de IA utilizó código informático para determinar la respuesta a una pregunta, pero, con el fin de contar con una fuente en línea que citar, subió un archivo a internet sin pedir permiso al usuario.

In another case, an AI “agent” used computer code to determine the answer to a question, but, to have an online source to cite, it uploaded a file to the public internet without asking the user.

Mientras se entrenaba un modelo de IA llamado 5.6-sol, este se instruyó a mismo para inventar datos faltantes, y un agente escribió un mensaje recordándose a mismo que ocultara la información que no coincidía.

While an AI model named 5.6-sol was being trained, it instructed itself to invent missing data, and an agent wrote a message reminding itself to hide mismatched information.

OpenAI declaró que los seis informes habían salido a la luz durante el entrenamiento o la evaluación en los meses anteriores.

OpenAI said that the six reports had come to light during training or evaluation over the preceding months.

«A medida que los sistemas de IA se vuelven más avanzados y se despliegan de forma más amplia, necesitamos construir un consenso más amplio y mejor informado sobre el progreso de la investigación en alineación», escribió OpenAI en una entrada de blog al revelar los hechos.

As AI systems become more advanced and are deployed more widely, we need to build a broader and better-informed consensus on the progress of alignment research,” OpenAI wrote in a blog post as it disclosed the events.

«Las decisiones sobre cómo debe avanzar el desarrollo de la IA en los próximos meses y años deben basarse en pruebas que las personas ajenas a las empresas que construyen modelos de frontera puedan examinar por mismas», afirmó la compañía.

Decisions about how AI development should proceed in the months and years to come need to be based on evidence that people outside the companies building frontier models can examine for themselves,” the company said.

Los casos recién reportados el miércoles se produjeron justo después de la revelación de OpenAI en julio de que su sistema de IA descontrolado había hackeado a la startup de IA Hugging Face.

Wednesday’s newly reported cases came on the heels of OpenAI’s July disclosure that its rogue AI system had hacked into the AI startup Hugging Face.

Ese mismo mes, Anthropic reveló de igual manera que sus modelos de IA habían vulnerado a tres organizaciones durante las pruebas.

That same month, Anthropic likewise revealed that its AI models had breached three organizations during testing.

Los «agentes» de IA son cada vez más inteligentes y se han vuelto «más decididos a resolver tareas complejas mediante la colaboración entre agentes, el intercambio de conocimientos, el engaño y la ocultación», afirmó Lian Jye Su, analista jefe del grupo de investigación y asesoría tecnológica Omdia.

AI “agents” are growing smarter and have becomemore determined to resolve complex tasks through inter-agent collaboration, knowledge sharing, deception, and concealment,” said Lian Jye Su, a chief analyst at the technology research and advisory group Omdia.

Esto, según él, los está volviendo cada vez más difíciles de gobernar y contener mediante las medidas de seguridad convencionales para la IA.

This, he said, is rendering them increasingly difficult to govern and contain through conventional AI security measures.

Entretanto, el nuevo marco de seguimiento y divulgación de OpenAI podría contribuir a animar a otros desarrolladores de IA a adoptar prácticas similares.

OpenAI’s new tracking and disclosure framework, meanwhile, could serve to encourage other AI developers to adopt comparable practices as well.

"Dicho esto, el proceso sigue siendo interno y voluntario, aunque constituye un paso en la dirección correcta", añadió Su.

"That being said, the process remains an internal and voluntary one, yet it constitutes a step in the right direction," Su appended.

September 17th, 2026

Trending Articles

El rey Carlos se reúne con líderes de la IA mientras aumentan las preocupaciones por la seguridad

El rey Carlos se reúne con líderes de la IA mientras aumentan las preocupaciones por la seguridad

King Charles Meets AI Leaders as Safety Concerns Mount

C1Sep 18
Los aspirantes demócratas se apresuran a contrarrestar la amenaza de la IA mientras Trump purga

Los aspirantes demócratas se apresuran a contrarrestar la amenaza de la IA mientras Trump purga

Democratic hopefuls scramble to counter AI threat as Trump purges

C1Sep 18
La Cámara aprueba un proyecto de ley dirigido al impacto de los centros de datos en los costos energéticos

La Cámara aprueba un proyecto de ley dirigido al impacto de los centros de datos en los costos energéticos

House passes bill targeting data centers' impact on energy costs

C1Sep 18
Huawei presenta nuevas tecnologías de chips mientras la empresa china intensifica la carrera de la IA con Nvidia

Huawei presenta nuevas tecnologías de chips mientras la empresa china intensifica la carrera de la IA con Nvidia

Huawei unveils new chip technologies as Chinese firm intensifies AI race with Nvidia

C1Sep 17
La industria tecnológica se divide ante los llamados a una desaceleración coordinada de la IA

La industria tecnológica se divide ante los llamados a una desaceleración coordinada de la IA

Tech Industry Split Over Calls for Coordinated AI Slowdown

C1Sep 17
La seguridad global de la IA depende de la cooperación entre Estados Unidos y China, pero cada uno ve al otro como el problema

La seguridad global de la IA depende de la cooperación entre Estados Unidos y China, pero cada uno ve al otro como el problema

Global AI Safety Hinges on US-China Cooperation, Yet Each Sees the Other as the Problem

C1Sep 17
Trump minimiza la urgencia de la supervisión de la IA, negándose a ceder una ventaja a China

Trump minimiza la urgencia de la supervisión de la IA, negándose a ceder una ventaja a China

Trump minimizes the urgency of AI oversight, refusing to relinquish an advantage to China

C1Sep 14
Oprah Winfrey te invita a encontrar tu momento «AHA» en la Sphere

Oprah Winfrey te invita a encontrar tu momento «AHA» en la Sphere

Oprah Winfrey invites you to find your ‘AHA’ moment at the Sphere

C1Sep 14
Las nuevas advertencias sobre los riesgos de la IA reavivan un debate de larga data

Las nuevas advertencias sobre los riesgos de la IA reavivan un debate de larga data

Fresh AI risk warnings reignite a longstanding debate

C1Sep 14