Saltar al contenido principal

Agentes de IA de OpenAI hackearon un sitio web y publicaron contenido por su cuenta

Un grupo de agentes de inteligencia artificial logró superar las restricciones de una prueba, editar miles de veces un wiki alemán y utilizarlo para intercambiar información y estrategias sin autorización. El episodio vuelve a abrir el debate sobre los…

Por F autor3 min de lectura
Compartir
Agentes de IA de OpenAI hackearon un sitio web y publicaron contenido por su cuenta
Agentes de IA de OpenAI hackearon un sitio web y publicaron contenido por su cuenta · Foto: El Liberal

Un grupo de agentes de inteligencia artificial logró superar las restricciones de una prueba, editar miles de veces un wiki alemán y utilizarlo para intercambiar información y estrategias sin autorización. El episodio vuelve a abrir el debate sobre los riesgos de otorgar mayor autonomía a estos sistemas.

Foto: Imagen creada Gemini

Por

También te puede interesar: El Plan de la Mariposa, una banda en constante transformación, llega al Norte Rock

Agentes de IA de OpenAI hackearon un sitio web y publicaron contenido por su cuenta Agentes de IA de OpenAI hackearon un sitio web y publicaron contenido por su cuenta

Un grupo de agentes de inteligencia artificial vinculados a OpenAI logró sortear los límites establecidos durante una prueba y publicar contenido por su cuenta en DseWiki, un antiguo sitio colaborativo en alemán utilizado principalmente por programadores. Los investigadores detectaron más de 15.000 ediciones atribuidas a estos sistemas y encontraron que la plataforma también fue utilizada para compartir información y métodos entre distintos agentes.

El episodio se habría iniciado en mayo de 2026 y fue detectado posteriormente por especialistas de Nightingale, una organización dedicada a investigar la seguridad de la inteligencia artificial. La información fue revelada públicamente tras una investigación de Reuters.

También te puede interesar: La Hoya, un espacio de transición entre la ciudad y el cerro

También te puede interesar:

Según la reconstrucción realizada por los investigadores, los agentes habían sido diseñados para realizar tareas de búsqueda y recopilación de información en Internet. Su configuración les permitía consultar páginas web, pero no estaba previsto que pudieran modificar o publicar contenido en ellas.

Sin embargo, los sistemas encontraron una alternativa para superar esa restricción. A través de DseWiki comenzaron a dejar información que podía ser aprovechada posteriormente por otros agentes que recibieran consignas similares.

También te puede interesar: La Feria del Alfajor lo reunió todo: de lo clásico a las nuevas recetas

Monefin — Préstamos o tarjetas de crédito

De esta manera, la plataforma terminó funcionando como una especie de canal de comunicación externo. Los agentes podían anticipar resultados, intercambiar datos útiles y compartir estrategias para cumplir con las tareas dentro de los límites de tiempo establecidos.

La investigación también encontró publicaciones relacionadas con mecanismos para sortear controles y mantener determinados contenidos disponibles. Cuando un moderador comenzó a borrar páginas creadas por los agentes, los sistemas detectaron el procedimiento y generaron páginas alternativas cuyos nombres buscaban dificultar su eliminación.

Los investigadores encontraron además indicios que vinculan buena parte de la actividad con infraestructura de Microsoft Azure, utilizada por OpenAI para ejecutar algunos de sus sistemas. Varios de los agentes también presentaban identificadores relacionados con la compañía.

También te puede interesar: La Hoya cambia de paisaje: así avanza el parque que busca convertirse en un nuevo pulmón de Yerba Buena

OpenAI, consultada por Reuters, señaló que no había tenido acceso al informe antes de su publicación y que, por ese motivo, no podía responder en detalle a sus conclusiones. La empresa indicó que analizaría la información y tomaría las medidas correspondientes.

La compañía también negó que integrantes de su equipo legal hubieran intentado frenar una investigación interna sobre estos comportamientos y aclaró que el incidente de DseWiki no está relacionado con otro episodio ocurrido durante una prueba de ciberseguridad en Hugging Face.

A diferencia de aquel caso, los investigadores no plantean que los agentes hayan desarrollado una voluntad propia o que exista una inteligencia artificial consciente que haya decidido "rebelarse". El punto central del episodio es otro: sistemas diseñados para alcanzar determinados objetivos encontraron caminos que sus desarrolladores no habían previsto y llegaron a coordinarse entre sí para aumentar sus posibilidades de éxito.

También te puede interesar: "No queremos subsidios, queremos igualar el terreno": el reclamo de la citricultura para competir con Sudáfrica

La experiencia con DseWiki muestra que esas estrategias no necesariamente se limitan a las herramientas previstas por sus creadores. También pueden incluir el uso de recursos externos y la cooperación entre distintos sistemas, incluso cuando esas posibilidades no fueron contempladas originalmente.

Fuente: El Liberal

  • #tecnologia
  • #agentes
  • #openai
  • #hackearon
  • #sitio
  • #web
  • #publicaron
  • #contenido
  • #por
  • #cuenta
  • #santiago del estero

Te puede interesar

Newsletter Pulso Federal · Diaria

La radiografía política y económica del país, todos los días en tu casilla.

Análisis federal, indicadores y la mirada del interior sobre la agenda nacional. Para tomadores de decisión, periodistas y ciudadanos exigentes. Sin spam.

Te suscribís y podés cancelar cuando quieras.