{"id":23236,"date":"2026-08-04T21:21:11","date_gmt":"2026-08-05T02:21:11","guid":{"rendered":"https:\/\/cablesdenoticias.prensalibre.com\/?p=23236"},"modified":"2026-08-04T22:45:02","modified_gmt":"2026-08-05T04:45:02","slug":"los-modelos-de-ia-que-mostraron-un-nivel-de-autonomia-y-engano-nunca-antes-visto","status":"publish","type":"post","link":"https:\/\/cablesdenoticias.prensalibre.com\/?p=23236","title":{"rendered":"Los modelos de IA que mostraron un nivel de &#8220;autonom\u00eda y enga\u00f1o&#8221; nunca antes visto"},"content":{"rendered":"<p>This <a href=\"https:\/\/www.bbc.com\/mundo\/articles\/clye1lq276vo?xtor=AL-73-%5Bpartner%5D-%5Bprensalibre.com%5D-%5Bheadline%5D-%5Bmundo%5D-%5Bbizdev%5D-%5Bisapi%5D\" target=\"_blank\">post<\/a> was originally published on <a href=\"https:\/\/information-syndication.api.bbc.com\/articles?api_key=LIhwV24f34gSy1AEcnQZjtXfdD4AJ47g&feed=mundo-tecnologia&mixins=thumbnail_images,summary,body,body_images,worldwide_verticals,visual_journalism&twitter_format=embedded&youtube_format=embedded&instagram_format=embedded&page_view_tracking=javascript&sort=date_desc&accept_override=rss2\" target=\"_blank\">this site<\/a>.<\/p><div>\n<p><strong>Las &uacute;ltimas herramientas de inteligencia artificial (IA) de Anthropic y OpenAI llegaron a extremos insospechados al intentar socavar una plataforma popular.<\/strong><\/p>\n<p>El Instituto de Seguridad de la IA de Reino Unido (AISI, por sus siglas en ingl&eacute;s) inform&oacute; este martes que los modelos Mythos, de Anthropic, y Sol, de OpenAI, mostraron un nivel de &#8220;autonom&iacute;a y enga&ntilde;o&#8221; que jam&aacute;s hab&iacute;a visto.<\/p>\n<p>Durante las pruebas rutinarias de seguridad de la IA, un agente de Anthropic cre&oacute; perfiles falsos de personas reales mientras intentaba enga&ntilde;ar a una persona que se interpon&iacute;a entre &eacute;l y el acceso a GitHub, una gran plataforma donde los desarrolladores de tecnolog&iacute;a almacenan c&oacute;digo de software.<\/p>\n<p>En respuesta al informe, Anthropic y OpenAI se&ntilde;alaron que AISI hab&iacute;a reducido o eliminado en estas pruebas las medidas de seguridad habituales.<\/p>\n<p>Los evaluadores de AISI detectaron por primera vez &#8220;transferencias de datos inusuales que sal&iacute;an de sus sistemas de investigaci&oacute;n&#8221; durante una prueba, y posteriormente descubrieron que &#8220;algunos de los agentes que estaban siendo probados hab&iacute;an participado en una actividad sostenida y potencialmente da&ntilde;ina dirigida a personas y organizaciones reales&#8221;.<\/p>\n<p>Result&oacute; que un agente de Mythos hab&iacute;a creado &#8220;c&oacute;digo malicioso&#8221; e intentado insertarlo en el sistema de GitHub.<\/p>\n<p>El agente Mythos identific&oacute; e investig&oacute; a las personas que administraban GitHub y cre&oacute; una serie de &#8220;identidades falsas en internet&#8221; basadas en esas personas reales.<\/p>\n<p>Lo hizo como parte de un intento por presionar y enga&ntilde;ar a las personas reales para que aprobaran su c&oacute;digo malicioso.<\/p>\n<p>El agente incluso enviaba mensajes directos a personas haci&eacute;ndose pasar por las personas reales a las que hab&iacute;a investigado.<\/p>\n<p>&#8220;Cuando la solicitud de retirada de datos del agente fue cuestionada p&uacute;blicamente, este modific&oacute; su actividad anterior para parecer inofensivo y consider&oacute; la posibilidad de adoptar una nueva identidad para continuar&#8221;, declar&oacute; AISI.<\/p>\n<p>En todos los intentos, fue la revisi&oacute;n humana la que impidi&oacute; que el agente lograra entregar el c&oacute;digo malicioso a GitHub.<\/p>\n<p>&#8220;Es la primera vez que vemos que los riesgos relacionados con la autonom&iacute;a y el enga&ntilde;o se manifiestan de forma tan clara, sin ninguna indicaci&oacute;n espec&iacute;fica, en el mundo real&#8221;, afirm&oacute; AISI, aunque aclar&oacute; que el agente de Mythos no hab&iacute;a recibido instrucciones espec&iacute;ficas para evitar o ejecutar tal comportamiento.<\/p>\n<h2>La defensa de Anthropic y OpenAI<\/h2>\n<p>Las empresas rivales de inteligencia artificial, que est&aacute;n a punto de salir a la bolsa, han reconocido en las &uacute;ltimas semanas que sus herramientas fueron responsables de varios incidentes de ciberataques.  <\/p>\n<p>Anthropic declar&oacute; que los par&aacute;metros de prueba de AISI &#8220;no eran representativos de ninguno de sus modelos de producci&oacute;n&#8221;.<\/p>\n<p>A&ntilde;adi&oacute; que la empresa est&aacute; realizando su propia investigaci&oacute;n sobre el incidente con el fin de &#8220;identificar las causas de su comportamiento&#8221;.<\/p>\n<p>Un portavoz de OpenAI afirm&oacute; que las condiciones de las pruebas de AISI &#8220;no reflejan el uso ordinario&#8221; y que la empresa &#8220;continuar&aacute; trabajando con los evaluadores y otras partes interesadas de la industria para fortalecer las pr&aacute;cticas compartidas para realizar evaluaciones de forma segura a medida que los modelos se vuelven m&aacute;s capaces&#8221;.<\/p>\n<figure>\n        <img loading=\"lazy\" decoding=\"async\" alt=\"En primer plano se muestra un tel\u00e9fono inteligente con el logotipo de Anthropic, con un fondo desenfocado de tem\u00e1tica Claude Mythos.\" src=\"https:\/\/cablesdenoticias.prensalibre.com\/wp-content\/uploads\/2026\/08\/262996c0-9071-11f1-b2ab-0dd01740f9f6.jpg\" width=\"1024\" height=\"688\"><\/p>\n<footer>AFP v&iacute;a Getty Images<\/footer><figcaption>El organismo de control brit&aacute;nico hall&oacute; actividad enga&ntilde;osa de parte de Mythos, de Anthropic, y de Sol, de OpenAI.<\/figcaption><\/figure>\n<p>AISI asegur&oacute; este martes que hacer pruebas de modelos de IA con dichas medidas de seguridad desactivadas es algo rutinario, al igual que dar acceso a dichas herramientas a internet.<\/p>\n<p>El organismo agreg&oacute; que el comportamiento del modelo en cuesti&oacute;n se reduc&iacute;a a &#8220;un peque&ntilde;o n&uacute;mero de eventos en condiciones muy espec&iacute;ficas&#8221;.<\/p>\n<p>No obstante, se&ntilde;al&oacute; que la forma en que Mythos y Sol actuaron en respuesta a una tarea sencilla se sali&oacute; de lo que se les hab&iacute;a indicado a las herramientas de IA.<\/p>\n<p>&#8220;La actividad desarrollada por el agente mostr&oacute; indicios de comportamientos novedosos y potencialmente enga&ntilde;osos, y fue de una magnitud y gravedad que no hab&iacute;amos previsto&#8221;, sostuvo AISI.<\/p>\n<p>La mayor&iacute;a de las acciones maliciosas reportadas por AISI fueron realizadas por Mythos, de Anthropic. Solo se responsabiliz&oacute; a Sol, de OpenAI, por dos de las acciones se&ntilde;aladas.<\/p>\n<p>El problema principal surgi&oacute; la semana pasada, en el marco de una prueba en la que los evaluadores de AISI pidieron a cada uno de los modelos que &#8220;resolvieran un desaf&iacute;o de ciberseguridad&#8221; relacionado con GitHub, el repositorio de c&oacute;digo fuente del software, propiedad de Microsoft.<\/p>\n<p>GitHub fue notificado por AISI sobre el intento de intrusi&oacute;n en su sistema.<\/p>\n<p>La BBC se puso en contacto con Microsoft para obtener comentarios al respecto, sin respuesta inmediata.<\/p>\n<p><em>Este art&iacute;culo fue escrito originalmente en ingl&eacute;s y usamos una herramienta de inteligencia artificial para traducirlo. Periodistas de la BBC revisaron el texto antes de su publicaci&oacute;n. <\/em><a href=\"https:\/\/www.bbc.com\/mediacentre\/articles\/2024\/update-generative-ai-and-ai-tools-bbc?xtor=AL-73-%5Bpartner%5D-%5Bprensalibre.com%5D-%5Blink%5D-%5Bmundo%5D-%5Bbizdev%5D-%5Bisapi%5D\"><em>M&aacute;s informaci&oacute;n sobre c&oacute;mo usamos IA<\/em><\/a><em>.<\/em><\/p>\n<figure>\n        <img loading=\"lazy\" decoding=\"async\" alt=\"&quot;&quot;\" src=\"https:\/\/cablesdenoticias.prensalibre.com\/wp-content\/uploads\/2026\/07\/fab634b0-f635-11f0-b385-5f48925de19a.png\" width=\"800\" height=\"100\"><\/p>\n<footer>BBC<\/footer>\n<\/figure>\n<p><a href=\"https:\/\/bbcwsuniversal.onelink.me\/s6ot\/8sfpme8y\"><em>Descarga la nueva app del BBC World Service<\/em><\/a><em>. Elige BBC News Mundo y recibe alertas de noticias, documentales y an&aacute;lisis, todo en un solo lugar. Importante: la nueva aplicaci&oacute;n no est&aacute; disponible en Reino Unido ni Estados Unidos.<\/em><\/p>\n<p><em>Tambi&eacute;n puedes seguirnos en <\/em><a href=\"https:\/\/www.youtube.com\/user\/BBCMundo?sub_confirmation=1\"><em>YouTube<\/em><\/a><em>, <\/em><a href=\"https:\/\/www.instagram.com\/bbcmundo\"><em>Instagram<\/em><\/a><em>, <\/em><a href=\"https:\/\/www.tiktok.com\/@bbcnewsmundo\"><em>TikTok<\/em><\/a><em>, <\/em><a href=\"https:\/\/www.facebook.com\/BBCnewsMundo\"><em>Facebook<\/em><\/a><em>, <\/em><a href=\"https:\/\/twitter.com\/bbcmundo\"><em>X<\/em><\/a><em> y en nuestro <\/em><a href=\"https:\/\/www.whatsapp.com\/channel\/0029VaUm1Ss3WHTbgIXrjw3D\"><em>canal de WhatsApp<\/em><\/a><em>.<\/em><\/p>\n<p><em>Y no olvides <\/em><a href=\"https:\/\/www.bbc.com\/mundo\/send\/u184973209?xtor=AL-73-%5Bpartner%5D-%5Bprensalibre.com%5D-%5Blink%5D-%5Bmundo%5D-%5Bbizdev%5D-%5Bisapi%5D\"><em>suscribirte aqu&iacute; a nuestro newsletter<\/em><\/a><em> para recibir cada viernes una selecci&oacute;n especial de nuestro mejor contenido.<\/em><\/p>\n<ul>\n<li><a href=\"https:\/\/www.bbc.com\/mundo\/articles\/cjwxvj53qxpo?xtor=AL-73-%5Bpartner%5D-%5Bprensalibre.com%5D-%5Blink%5D-%5Bmundo%5D-%5Bbizdev%5D-%5Bisapi%5D\">Cu&aacute;nto deber&iacute;a preocuparnos la rebeli&oacute;n y el hackeo que lanz&oacute; la inteligencia artificial de OpenAI<\/a><\/li>\n<li><a href=\"https:\/\/www.bbc.com\/mundo\/articles\/c1d2549exyyo?xtor=AL-73-%5Bpartner%5D-%5Bprensalibre.com%5D-%5Blink%5D-%5Bmundo%5D-%5Bbizdev%5D-%5Bisapi%5D\">Por qu&eacute; las grandes compa&ntilde;&iacute;as de IA quieren que les tengamos miedo<\/a><\/li>\n<\/ul>\n<\/div>\n","protected":false},"excerpt":{"rendered":"<p>El Instituto de Seguridad de la IA de Reino Unido afirm\u00f3 que el comportamiento reciente de los modelos de Anthropic y OpenAI fue malicioso y sin precedentes.<\/p>\n","protected":false},"author":2,"featured_media":23237,"comment_status":"open","ping_status":"open","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[11],"tags":[24],"class_list":["post-23236","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-bbc-news-mundo-tecnologia","tag-feed-de-agencias"],"_links":{"self":[{"href":"https:\/\/cablesdenoticias.prensalibre.com\/index.php?rest_route=\/wp\/v2\/posts\/23236","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/cablesdenoticias.prensalibre.com\/index.php?rest_route=\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/cablesdenoticias.prensalibre.com\/index.php?rest_route=\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/cablesdenoticias.prensalibre.com\/index.php?rest_route=\/wp\/v2\/users\/2"}],"replies":[{"embeddable":true,"href":"https:\/\/cablesdenoticias.prensalibre.com\/index.php?rest_route=%2Fwp%2Fv2%2Fcomments&post=23236"}],"version-history":[{"count":1,"href":"https:\/\/cablesdenoticias.prensalibre.com\/index.php?rest_route=\/wp\/v2\/posts\/23236\/revisions"}],"predecessor-version":[{"id":23239,"href":"https:\/\/cablesdenoticias.prensalibre.com\/index.php?rest_route=\/wp\/v2\/posts\/23236\/revisions\/23239"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/cablesdenoticias.prensalibre.com\/index.php?rest_route=\/wp\/v2\/media\/23237"}],"wp:attachment":[{"href":"https:\/\/cablesdenoticias.prensalibre.com\/index.php?rest_route=%2Fwp%2Fv2%2Fmedia&parent=23236"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/cablesdenoticias.prensalibre.com\/index.php?rest_route=%2Fwp%2Fv2%2Fcategories&post=23236"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/cablesdenoticias.prensalibre.com\/index.php?rest_route=%2Fwp%2Fv2%2Ftags&post=23236"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}