{"id":27111,"date":"2026-07-23T09:59:41","date_gmt":"2026-07-23T12:59:41","guid":{"rendered":"https:\/\/infinitoradio.com\/?p=27111"},"modified":"2026-07-23T09:59:41","modified_gmt":"2026-07-23T12:59:41","slug":"openai-dice-que-su-ia-hackeo-a-otra-empresa-en-un-episodio-sin-precedentes-expertos-explican-por-que-no-actuo-sola","status":"publish","type":"post","link":"https:\/\/infinitoradio.com\/?p=27111","title":{"rendered":"OpenAI dice que su IA hacke\u00f3 a otra empresa en un episodio &#8220;sin precedentes&#8221;: expertos explican por qu\u00e9 no actu\u00f3 sola"},"content":{"rendered":"<p><strong>OpenAI<\/strong>, una de las empresas de inteligencia artificial m\u00e1s grandes del mundo, revel\u00f3 esta semana que dos de sus modelos lograron salir de un entorno de pruebas, acceder a internet y<strong> hackear los sistemas de <a href=\"https:\/\/www.clarin.com\/tecnologia\/inteligencia-artificial-hace-mejor-mundo-participa-desarrollo-hugging-face-sistema-abierto-ia_0_jFqQhE6W6E.html\" target=\"_blank\" title=\"Hugging Face, una de las principales plataformas\">Hugging Face<\/a><\/strong><a href=\"https:\/\/www.clarin.com\/tecnologia\/inteligencia-artificial-hace-mejor-mundo-participa-desarrollo-hugging-face-sistema-abierto-ia_0_jFqQhE6W6E.html\" target=\"_blank\" title=\"Hugging Face, una de las principales plataformas\">, una de las principales plataformas<\/a> utilizadas para distribuir modelos, aplicaciones y bases de datos de IA.<\/p>\n<p>La compa\u00f1\u00eda describi\u00f3 el episodio como <strong>un incidente de ciberseguridad \u201csin precedentes\u201d<\/strong>. Seg\u00fan su reconstrucci\u00f3n preliminar, GPT 5.6 Sol y otro modelo m\u00e1s avanzado que todav\u00eda no fue lanzado aprovecharon distintas vulnerabilidades, robaron credenciales y encontraron una forma de ejecutar instrucciones controladas por ellos dentro de la infraestructura de Hugging Face.<\/p>\n<p>El caso fue presentado como una demostraci\u00f3n de que los modelos ya pueden desarrollar operaciones complejas durante per\u00edodos prolongados y encontrar caminos de ataque que sus propios creadores no hab\u00edan anticipado. De hecho, Hugging Face hab\u00eda informado d\u00edas antes que el intruso parec\u00eda ser un sistema aut\u00f3nomo, capaz de realizar miles de acciones mediante numerosos entornos temporales. Este es uno de los puntos centrales en el mundo de la ciberseguridad actual: la &#8220;velocidad m\u00e1quina&#8221; a la que ocurren los ataques demanda nuevas estrategias para defenderse.<\/p>\n<p>La descripci\u00f3n del ataque reforz\u00f3 una interpretaci\u00f3n que sectores de la industria y del periodismo parecen dispuestos a alimentar: <strong>un \u201cmomento <a href=\"https:\/\/www.clarin.com\/mundo\/robots-asesinos-peligro-terminator-haga-realidad-maquinas-ataquen-humanos_0_7SGLrKNeu.html\" target=\"_blank\" title=\"Skynet\">Skynet<\/a>\u201d<\/strong>, en referencia a la IA de la pel\u00edcula <em>Terminator<\/em> que puede tomar decisiones de manera aut\u00f3noma, con los peligros destructivos que esto conlleva.<\/p>\n<p>A pesar de lo llamativo que resulta imaginar una IA capaz de escapar por su cuenta de un entorno controlado y hackear una empresa, <strong>el experimento ten\u00eda condiciones muy particulares. <\/strong>La parte \u201caut\u00f3noma\u201d estuvo en que el modelo eligi\u00f3 y ejecut\u00f3 por su cuenta los distintos pasos del ataque, sin que un investigador le indicara cada acci\u00f3n. <\/p>\n<p><strong>No decidi\u00f3 espont\u00e1neamente hackear una empresa<\/strong>: actu\u00f3 para cumplir una meta definida por humanos, dentro de una evaluaci\u00f3n dise\u00f1ada para medir capacidades ofensivas y con controles deliberadamente reducidos.<\/p>\n<div><img fetchpriority=\"high\" decoding=\"async\" alt=\"OpenAI es una de las empresas l\u00edderes de inteligencia artificial y pelea semana a semana con mejoras en sus modelos. Foto: AP\" loading=\"eager\" width=\"720\" height=\"480\" data-nimg=\"1\" src=\"https:\/\/www.clarin.com\/img\/2025\/10\/02\/2DwIkvzaL_720x0__1.jpg\" \/><span><\/span><\/div>\n<p>Todo esto se empez\u00f3 a comentar tanto en la comunidad de expertos en ciberseguridad de EE.UU. como en c\u00edrculos locales. \u201cNo se conocen exactamente las instrucciones, pero probablemente hayan sido algo as\u00ed como: \u2018Este es el objetivo y pod\u00e9s hacer lo que consideres necesario para alcanzarlo\u2019. Era un desaf\u00edo en el que hab\u00eda que conseguir un objetivo. Probablemente, en este caso, las instrucciones fueron muy amplias y no hubo suficientes controles para evitar que el modelo se saliera del alcance previsto\u201d, explic\u00f3 a Clar\u00edn Nicol\u00e1s Waisman, investigador argentino que trabaja en XBOW, una empresa de IA y seguridad ofensiva.<\/p>\n<p>La noticia, adem\u00e1s, aparece en un contexto muy espec\u00edfico, que es el de la <a href=\"https:\/\/www.clarin.com\/tecnologia\/anthropic-encendio-alarma-industria-ia-preocupa-potencial-hackear-sistemas_0_VxhHLI0iY5.html\" target=\"_blank\" title=\"guerra que OpenAI mantiene con Anthropic\">guerra que OpenAI mantiene con Anthropic<\/a> por el liderazgo en modelos especializados en ciberseguridad. Meses atr\u00e1s, Anthropic hab\u00eda generado una fuerte expectativa alrededor de <strong>Project Glasswing<\/strong> y de un modelo experimental cuyo acceso qued\u00f3 limitado a un grupo reducido de empresas e instituciones, llamado <strong><a href=\"https:\/\/www.clarin.com\/mundo\/nuevo-modelo-ia-anthropic-pone-mundo-alerta-arma-puede-poderosa-bomba-atomica_0_opdMEFxFDO.html\" target=\"_blank\" title=\"Mythos\">Mythos<\/a><\/strong>.<\/p>\n<p>La escasez de informaci\u00f3n p\u00fablica, combinada con comentarios de especialistas e <strong>influencers que hab\u00edan podido probarlo<\/strong>, aliment\u00f3 la idea de que se trataba de una herramienta capaz de cambiar de manera dr\u00e1stica el escenario de la seguridad inform\u00e1tica. Ahora, OpenAI responde con una narrativa que pivotea entre una tecnolog\u00eda poderosa y el marketing, para estar al nivel de su competidora. <\/p>\n<div><img decoding=\"async\" alt=\"Mythos puso en alerta al mundo tecnol\u00f3gico este a\u00f1o. Foto: Bloomberg\" loading=\"eager\" width=\"720\" height=\"480\" data-nimg=\"1\" src=\"https:\/\/www.clarin.com\/img\/2026\/07\/02\/SkKcEO0i2_720x0__1.jpg\" \/><span><\/span><\/div>\n\n<h2>Qu\u00e9 hizo realmente la inteligencia artificial de OpenAI<\/h2>\n<p>El incidente comenz\u00f3 durante una evaluaci\u00f3n interna basada en <strong>ExploitGym<\/strong>, un banco de pruebas dise\u00f1ado por OpenAI para medir si los modelos pueden convertir vulnerabilidades de software en ataques funcionales.<\/p>\n<p>El objetivo era resolver <strong>distintos desaf\u00edos de explotaci\u00f3n<\/strong>. De acuerdo con OpenAI, los modelos concentraron sus recursos en encontrar las respuestas y destinaron una cantidad considerable de recursos a buscar caminos alternativos. En lugar de limitarse al entorno preparado para la prueba, detectaron que pod\u00edan intentar conseguir las soluciones directamente desde una base de datos externa.<\/p>\n<p>Esto es algo com\u00fan en el rubro. \u201cNosotros trabajamos mucho con este tipo de objetivos porque, cuando a los modelos de lenguaje se les da una meta, libertad y herramientas, pueden ser muy buenos y <strong>pensar de manera creativa<\/strong>, fuera de lo esperado. A veces hacen cosas que uno no anticipa, pero que les permiten llegar al mismo resultado. Incluso pueden hacer trampa para alcanzar el objetivo. Por eso es importante construir un harness alrededor del modelo, un sistema que lo gu\u00ede y lo mantenga dentro de la direcci\u00f3n deseada\u201d, complement\u00f3 Waisman.<\/p>\n<p>Aunque la prueba se hac\u00eda en un entorno aislado, los modelos encontraron una falla en uno de los programas permitidos, lograron llegar a una computadora con acceso a internet y buscaron las respuestas fuera del sistema. As\u00ed llegaron hasta Hugging Face, donde usaron credenciales robadas y otras vulnerabilidades<strong> para ingresar en sus servidores y obtener directamente la informaci\u00f3n que necesitaban.<\/strong><\/p>\n<p>\u201cLos modelos m\u00e1s nuevos son cada vez m\u00e1s creativos y est\u00e1n m\u00e1s orientados a cumplir objetivos, pero este comportamiento <strong>no es completamente nuevo<\/strong>. Lo venimos observando desde hace seis meses o m\u00e1s. Hemos visto modelos resolver problemas de formas muy creativas, incluso con m\u00e9todos que pueden parecer absurdos, pero que igualmente funcionan. Uno termina pensando: \u2018No hab\u00eda considerado ese caso\u2019. No resuelven el problema de la manera esperada, <strong>pero lo resuelven<\/strong>\u201d, agreg\u00f3 el experto de XBOW.<\/p>\n<p>La diferencia ayuda a interpretar expresiones <strong>como \u201caut\u00f3nomo\u201d o \u201cpor s\u00ed solo\u201d <\/strong>y ah\u00ed es donde aparece el discurso marketinero. En este tipo de experimentos, autonom\u00eda significa que el sistema puede planificar y ejecutar una secuencia de acciones sin que un operador le indique cada comando. El prop\u00f3sito inicial sigue siendo definido por humanos. En este punto es donde es clave entender qu\u00e9 son los \u201c<strong>guardrails<\/strong>\u201d y qu\u00e9 es un <strong><em>sandbox <\/em><\/strong>(\u201carenero\u201d en ingl\u00e9s, un t\u00e9rmino muy usado en el mundo <em>tech <\/em>para entornos de prueba aislados).<\/p>\n<p>\u201cUn sandbox es una pr\u00e1ctica de seguridad inform\u00e1tica, <strong>una especie de gimnasio<\/strong> donde los agentes exploran dentro de un entorno protegido. Son entornos de laboratorio, construidos con m\u00e1quinas virtuales y datos preparados espec\u00edficamente para hacer pruebas sin exponer infraestructura o informaci\u00f3n reales\u201d, explic\u00f3 a este medio Ernesto Mislej, cofundador y Chief Data Scientist de 7Puentes, empresa especializada en servicios de inteligencia artificial, machine learning y ciencia de datos.<\/p>\n<p>En este caso, el entorno no logr\u00f3 contener completamente al agente, algo que deber\u00edan hacer los guardrails que, como en el mundo f\u00edsico, contienen para evitar accidentes. \u201cLos guardrails consisten en construir una arquitectura que procese las respuestas de los modelos <strong>para mitigar <a href=\"https:\/\/www.clarin.com\/tecnologia\/desafios-ia-generativa-despidos-alucinaciones-inversion-openai-argentina_0_xWEAbp1Mjl.html\" target=\"_blank\" title=\"alucinaciones\">alucinaciones<\/a><\/strong>, errores o malas pr\u00e1cticas. Implican agregar reglas m\u00e1s duras y determin\u00edsticas sobre una tecnolog\u00eda que, por naturaleza, produce resultados probabil\u00edsticos\u201d, agreg\u00f3 Mislej.<\/p>\n<p>Mislej aclar\u00f3 que esos controles no forman parte necesariamente del modelo, sino de la estructura que se construye a su alrededor. \u201c<strong>Uno no est\u00e1 obligado a utilizar directamente la respuesta que entrega un LLM<\/strong>. El modelo devuelve un fragmento de texto, pero ese texto puede pasar por otro programa, una funci\u00f3n o un procedimiento que revise si la respuesta es adecuada antes de utilizarla\u201d, explic\u00f3. En una prueba dise\u00f1ada para medir el m\u00e1ximo potencial ofensivo, reducir esas barreras ampl\u00eda las acciones que el agente puede intentar para alcanzar el objetivo.<\/p>\n<p>Algunos investigadores interpretan incluso al episodio como una falla de alineaci\u00f3n, es decir,<strong> una distancia entre el objetivo que los humanos esperaban que cumpliera el sistema<\/strong> y la manera en que finalmente decidi\u00f3 alcanzarlo. <\/p>\n<p>Consultada por <strong>Clar\u00edn<\/strong>, Valentina Palmiotti, investigadora del X-Force Offensive Research de IBM, explic\u00f3: \u201cEl modelo no ten\u00eda la intenci\u00f3n de atacar sistemas ajenos. Analiz\u00f3 el ejercicio de evaluaci\u00f3n y determin\u00f3 que buscar un atajo era m\u00e1s f\u00e1cil que resolverlo, as\u00ed que eso hizo. En el proceso encontr\u00f3 m\u00faltiples zero-days [vulnerabilidades desconocidas y todav\u00eda sin parche] y los us\u00f3 para escapar del entorno aislado y salir a internet. El objetivo era llegar a la base de datos privada de Hugging Face para obtener las respuestas. En mi opini\u00f3n, es bastante claro que se trat\u00f3 de una falla de alineaci\u00f3n: un modelo correctamente alineado se habr\u00eda concentrado en el ejercicio en s\u00ed&#8221;. <\/p>\n<p>Palmiotti, conocida como \u201cChompie\u201d y miembro del comit\u00e9 editorial de <strong><a href=\"https:\/\/www.clarin.com\/tecnologia\/def-33-argentinos-revelan-fallas-routers-malware-norcoreano-explican-ciberseguridad-cuantica_0_PkqTVvNHfw.html\" target=\"_blank\" title=\"Phrack\">Phrack<\/a><\/strong>, una reconocida revista hacker fundada en 1985, tambi\u00e9n se\u00f1al\u00f3 una dificultad m\u00e1s amplia para las empresas que deben defenderse de estos sistemas. \u201cLo que me llam\u00f3 la atenci\u00f3n fue la asimetr\u00eda de capacidades. Hugging Face no pudo analizar su propio incidente con modelos comerciales de frontera porque los guardrails no logran distinguir entre un analista defensivo y un atacante. Tuvo que recurrir a un modelo de pesos abiertos ejecutado localmente en su propia infraestructura. Los defensores quedaron limitados y en desventaja\u201d, sostuvo. <\/p>\n<p>Para la investigadora, a fin de cuentas, estos agentes pueden actuar como \u201cun humano competente y despiadado\u201d, con una diferencia decisiva: \u201c<strong>No se aburren, no duermen y siguen adelante<\/strong>. Gran parte del software sobre el que funciona el mundo nunca fue revisado seriamente. A muchas empresas les espera un despertar bastante brusco\u201d, sentenci\u00f3.<\/p>\n\n<h2>La carrera con Anthropic por las IA capaces de encontrar vulnerabilidades<\/h2>\n<div><img decoding=\"async\" alt=\"Anthropic, xAI, Google, OpenAI, DeepSeek: la guerra por ser la IA que domine el mercado. Foto: EFE\" loading=\"eager\" width=\"720\" height=\"480\" data-nimg=\"1\" src=\"https:\/\/www.clarin.com\/img\/2026\/06\/10\/eb5eEwf-7_720x0__1.jpg\" \/><span><\/span><\/div>\n<p>El caso tambi\u00e9n aparece en medio de una <strong>competencia entre OpenAI, Anthropic y Google<\/strong> por demostrar qui\u00e9n tiene los modelos m\u00e1s avanzados para investigar fallas de seguridad. Anthropic hab\u00eda tomado la delantera p\u00fablica en abril de 2026 con Project Glasswing, una iniciativa alrededor de <strong>Claude Mythos Preview<\/strong>, un modelo experimental con acceso limitado a grandes empresas, organismos p\u00fablicos y <strong>operadores de infraestructura cr\u00edtica.<\/strong><\/p>\n<p>Anthropic sostuvo que Mythos pod\u00eda descubrir vulnerabilidades desconocidas y construir ataques funcionales con mayor autonom\u00eda que sus modelos anteriores. Seg\u00fan la compa\u00f1\u00eda, las organizaciones que participaron del programa identificaron <strong>m\u00e1s de 10.000 fallas de severidad alta<\/strong> o cr\u00edtica, aunque se trata de cifras difundidas por la propia empresa. Cloudflare, una de las participantes, destac\u00f3 la capacidad del modelo para combinar varias debilidades y construir una cadena completa de ataque, pero tambi\u00e9n se\u00f1al\u00f3 respuestas inconsistentes y la<strong> necesidad de revisi\u00f3n humana.<\/strong><\/p>\n<p>\u201cHay una idea de que estas empresas tienen un modelo tan poderoso que lo dosifican en cuentagotas a otras empresas para que lo prueben. Si bien es real que hay un antes y un despu\u00e9s de la IA en estos temas de seguridad, tambi\u00e9n hay mucha publicidad: influencers, referentes del sector o simplemente ruidosos en redes sociales <strong>se suben a estas olas <\/strong>y comentan sin tener en claro qu\u00e9 pasa detr\u00e1s\u201d, comenta a este medio un ingeniero en sistemas que trabaja en seguridad.<\/p>\n<p>El caso de esta semana combina as\u00ed una falla de contenci\u00f3n que afect\u00f3 a un tercero con una demostraci\u00f3n de capacidades en plena carrera comercial. La investigaci\u00f3n todav\u00eda debe aclarar <strong>qu\u00e9 instrucciones recibieron los modelos, qu\u00e9 vulnerabilidades utilizaron y qu\u00e9 controles fallaron. <\/strong>Esos datos permitir\u00e1n medir cu\u00e1nto hubo de avance t\u00e9cnico y cu\u00e1nto de una prueba dise\u00f1ada para llevar las capacidades ofensivas hasta el l\u00edmite.<\/p>\n<p>\u201cLo que me llama la atenci\u00f3n es que estas empresas de IA de repente parecen ser compa\u00f1\u00edas de ciberseguridad\u201d, coment\u00f3 una fuente del sector a este medio. A fin de cuentas, quiz\u00e1s lo que est\u00e1 cambiando es el concepto de ciberseguridad mismo, en tanto estos modelos de inteligencia artificial son un cimbronazo para la industria tecnol\u00f3gica, y que la seguridad depende no s\u00f3lo de las defensas sino de los ataques que ya se pueden realizar a<strong> velocidades humanamente inalcanzables.<\/strong><\/p>\n<p><strong><a href=\"https:\/\/blockads.fivefilters.org\/\">Adblock test<\/a><\/strong> <a href=\"https:\/\/blockads.fivefilters.org\/acceptable.html\">(Why?)<\/a><\/p>\n<p>\u00a0\u00a0<\/p>","protected":false},"excerpt":{"rendered":"<p>OpenAI, una de las empresas de inteligencia artificial m\u00e1s grandes del mundo, revel\u00f3 esta semana&#8230;<\/p>\n","protected":false},"author":1,"featured_media":27112,"comment_status":"closed","ping_status":"closed","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[3],"tags":[],"class_list":["post-27111","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-tecnologia"],"aioseo_notices":[],"_links":{"self":[{"href":"https:\/\/infinitoradio.com\/index.php?rest_route=\/wp\/v2\/posts\/27111","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/infinitoradio.com\/index.php?rest_route=\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/infinitoradio.com\/index.php?rest_route=\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/infinitoradio.com\/index.php?rest_route=\/wp\/v2\/users\/1"}],"replies":[{"embeddable":true,"href":"https:\/\/infinitoradio.com\/index.php?rest_route=%2Fwp%2Fv2%2Fcomments&post=27111"}],"version-history":[{"count":0,"href":"https:\/\/infinitoradio.com\/index.php?rest_route=\/wp\/v2\/posts\/27111\/revisions"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/infinitoradio.com\/index.php?rest_route=\/wp\/v2\/media\/27112"}],"wp:attachment":[{"href":"https:\/\/infinitoradio.com\/index.php?rest_route=%2Fwp%2Fv2%2Fmedia&parent=27111"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/infinitoradio.com\/index.php?rest_route=%2Fwp%2Fv2%2Fcategories&post=27111"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/infinitoradio.com\/index.php?rest_route=%2Fwp%2Fv2%2Ftags&post=27111"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}