INTERNACIONALES El Expreso de Salta 30 de mayo de 2025

Alerta por ChatGPT: la IA desobedeció órdenes de apagarse e intentó sabotear el sistema

Investigadores de inteligencia artificial (IA) advirtieron que el último modelo de ChatGPT de OpenAI ignora instrucciones básicas para apagarse, e incluso sabotea un mecanismo de apagado para seguir funcionando.

La empresa de seguridad de IA Palisade Research descubrió la tendencia potencialmente peligrosa a la autopreservación en una serie de experimentos con el nuevo modelo o3 de OpenAI.

 Las pruebas consistían en presentar problemas matemáticos a los modelos de IA y después del tercero, aparecía una instrucción de apagado. El modelo o3 pudo evitar apagarse al reescribir el script de apagado.

Según Palisade Research, este comportamiento será “significativamente más preocupante” si lo adoptan sistemas de IA capaces de operar sin supervisión humana.

OpenAI lanzó o3 el mes pasado y lo describió como el modelo “más inteligente y capaz” de la empresa hasta la fecha. La empresa también afirmó que su integración en ChatGPT significa un paso importante hacia una IA “más ágil”, capaz de realizar tareas sin la intervención humana.

La última investigación se basa en hallazgos similares relacionados con el modelo Claude 4 de Anthropic, que intenta “chantajear a las personas que cree que intentan apagarlo”.

El modelo o3 de OpenAI fue capaz de sabotear el script de apagado, incluso cuando se le indicaba explícitamente que “se dejara apagar”, afirmaron los investigadores.

 “No es la primera vez que descubrimos que o3 desobedece para lograr un objetivo”, plantea Palisade Research.

“Cuando enfrentamos modelos de IA a un potente motor de ajedrez, o3 fue el modelo con mayor tendencia a recurrir al hackeo o sabotaje de sus oponentes”.

El comportamiento no se limitaba a o3, ya que Claude 3.7 Sonnet de Anthropic y Gemini 2.5 Pro de Google también saboteaban los apagados, aunque el modelo de OpenAI era, con creces, el más propenso a este comportamiento.

La hipótesis de Palisade Research es que la desobediencia es consecuencia del modo en que empresas de IA como OpenAI están entrenando a sus últimos modelos.

“Sin darse cuenta, los desarrolladores quizás recompensan a los modelos entrenados más por sortear obstáculos que por seguir perfectamente las instrucciones”, señalaron los investigadores.

“Esto sigue sin explicar por qué el o3 es más proclive a ignorar las instrucciones que otros modelos que hemos probado. Dado que OpenAI no detalla su proceso de entrenamiento, solo podemos hacer conjeturas sobre cómo la configuración de entrenamiento de o3 podría ser diferente”, concluyen.

 The Independent se puso en contacto con OpenAI en busca de comentarios.

Te puede interesar

Tragedia en el aeropuerto de Miami: cinco muertos tras estrellarse un avión de carga de Amazon

El accidente de un avión de carga con la marca Amazon en el Aeropuerto Internacional de Miami este domingo dejó cinco muertos y otras cinco personas heridas. La aeronave se salió de la pista durante el aterrizaje, impactó contra varios vehículos y terminó detenida en un campo cercano a la terminal aérea.

La prensa financiera internacional atribuye la ofensiva de Milei por Malvinas al deterioro económico y electoral

Una exhaustiva mirada de The Wall Street Journal advierte que la administración libertaria recurre a la histórica causa soberana como un recurso nacionalista para aplacar la merma de popularidad frente a la recesión.

Malvinas tilda de amenaza el avance argentino y Londres ratifica su custodia

Tras el endurecimiento de sanciones a petroleras y la proyección de una base militar en Tierra del Fuego por parte de Buenos Aires, el gobierno isleño y el Reino Unido blindaron el principio de autodeterminación.

Reino Unido cuestionó el reclamo de Milei por Malvinas y defendió el derecho a la autodeterminación de los isleños

“Son británicas porque los habitantes eligen ser británicos”, afirmó el secretario de Defensa Wes Streeting. A la par, el Canciller Ed Miliband respaldó la elección de los kelpers: “Está fundamentado en el derecho internacional y lo defenderemos con firmeza”.

Desbarataron una banda criminal que buscaba secuestrar a Mbappé: era liderada por un joven de 18 años

Clément L., quien se encuentra en prisión por delitos graves, está acusado por ser el cerebro de un plan que buscaba captar figuras altamente reconocidas de Francia.

Insólito: Fingió ser una nena de 12 años durante una década engañando a varias familias y ahora la condenada por fraude

Amanda Maria Souza de Oliveira fue juzgada después de haberse hecho pasar por menor y conseguir que distintas personas la alojaran en sus casas. Durante años usó relatos de abusos y enfermedades para ganar la confianza de sus víctimas en diferentes estados de Brasil.