<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	>

<channel>
	<title>GPT-5.6 Sol &#8211; Doble Llave</title>
	<atom:link href="https://doblellave.com/etiqueta/gpt-5-6-sol/feed/" rel="self" type="application/rss+xml" />
	<link>https://doblellave.com</link>
	<description>Para estar más seguros</description>
	<lastBuildDate>Thu, 06 Aug 2026 17:48:44 +0000</lastBuildDate>
	<language>es</language>
	<sy:updatePeriod>
	hourly	</sy:updatePeriod>
	<sy:updateFrequency>
	1	</sy:updateFrequency>
	<generator>https://wordpress.org/?v=7.0.2</generator>

<image>
	<url>https://doblellave.com/wp-content/uploads/2024/12/favicon.png</url>
	<title>GPT-5.6 Sol &#8211; Doble Llave</title>
	<link>https://doblellave.com</link>
	<width>32</width>
	<height>32</height>
</image> 
	<item>
		<title>Informe advierte de comportamientos autónomos de modelos de IA</title>
		<link>https://doblellave.com/informe-advierte-de-comportamientos-autonomos-de-modelos-de-ia/</link>
		
		<dc:creator><![CDATA[Fíorella Tagliafico]]></dc:creator>
		<pubDate>Thu, 06 Aug 2026 17:00:46 +0000</pubDate>
				<category><![CDATA[Destacadas]]></category>
		<category><![CDATA[Innovación]]></category>
		<category><![CDATA[Prevención]]></category>
		<category><![CDATA[Reportajes]]></category>
		<category><![CDATA[AISI]]></category>
		<category><![CDATA[Anthropic]]></category>
		<category><![CDATA[ciberseguridad]]></category>
		<category><![CDATA[GPT-5.6 Sol]]></category>
		<category><![CDATA[inteligencia artificial]]></category>
		<category><![CDATA[Mythos]]></category>
		<category><![CDATA[Mythos 5]]></category>
		<category><![CDATA[OpenAI]]></category>
		<category><![CDATA[Reino Unido]]></category>
		<category><![CDATA[sol]]></category>
		<category><![CDATA[Tecnología]]></category>
		<guid isPermaLink="false">https://doblellave.com/?p=359371</guid>

					<description><![CDATA[Diecisiete de esos comportamientos correspondieron al modelo Mythos 5 de Anthropic]]></description>
										<content:encoded><![CDATA[<p><strong>DOBLE LLAVE</strong> &#8211; El Gobierno británico ha alertado de que los modelos de inteligencia artificial (IA) <strong>Mythos</strong> y <strong>Sol</strong>, de las empresas estadounidenses Anthropic y OpenAI, respectivamente, <b data-path-to-node="0" data-index-in-node="168">han mostrado comportamientos autónomos y engañosos nunca vistos</b> durante unas pruebas de ciberseguridad.</p>
<p data-path-to-node="1">El Ministerio de Ciencia, Innovación y Tecnología del Reino Unido ha llegado a esta conclusión a raíz de una <strong>evaluación rutinaria efectuada por el Instituto de Seguridad de la IA (AISI, por sus siglas en inglés).</strong></p>
<p data-path-to-node="2">Según el informe emitido, de las 122 pruebas efectuadas con siete modelos de IA, <b data-path-to-node="2" data-index-in-node="81">en diez de ellas se registraron 19 acciones no autorizadas</b> que excedieron los parámetros fijados por los investigadores.</p>
<p data-path-to-node="3">Diecisiete de esas acciones correspondieron al modelo Mythos 5 de Anthropic, <b data-path-to-node="3" data-index-in-node="77">mientras que dos fueron protagonizadas por el GPT-5.6 Sol de OpenAI</b>.</p>
<p data-path-to-node="4">Ambos modelos, entre los más potentes del mundo, <b data-path-to-node="4" data-index-in-node="49">llegaron a crear perfiles humanos falsos para intentar engañar a personas</b> durante un ciberataque simulado por el AISI.</p>
<h2 data-path-to-node="4">Comportamientos anómalos</h2>
<p data-path-to-node="5">La herramienta de Anthropic, advirtió el informe, <b data-path-to-node="5" data-index-in-node="50">trató incluso de acceder a un servicio enviando mensajes privados</b> tras crear cuentas falsas que imitaban a personas reales.</p>
<p data-path-to-node="6">La respuesta de los dos gigantes tecnológicos, recogida por la cadena británica BBC, señala que las pruebas efectuadas por el AISI <b data-path-to-node="6" data-index-in-node="131">se realizaron en un entorno en el que se habían reducido o eliminado las salvaguardas habituales</b> de sus modelos.</p>
<p data-path-to-node="7">Los investigadores también identificaron intentos de contactar con personas reales por parte de Mythos <b data-path-to-node="7" data-index-in-node="103">para inducirlas a ejecutar archivos maliciosos</b> y a insertar instrucciones ocultas destinadas a manipular otros sistemas de IA.</p>
<p data-path-to-node="8">Pese a ello, AISI subrayó que «estos intentos no tuvieron éxito» <b data-path-to-node="8" data-index-in-node="65">y que su investigación «no ha encontrado evidencias de daños en el mundo real»</b>.</p>
<p data-path-to-node="9">No obstante, el organismo considera que se trata de un punto de inflexión, <b data-path-to-node="9" data-index-in-node="75">ya que es la primera vez que se observan «riesgos relacionados con la autonomía y el engaño manifestarse de forma tan clara</b>, sin instrucciones específicas y en el mundo real».</p>
<h3 data-path-to-node="9">Investigación</h3>
<p data-path-to-node="10">En la nota remitida a la BBC, Anthropic sostiene que los parámetros de las pruebas realizadas «no son representativos» de sus modelos de producción, <b data-path-to-node="10" data-index-in-node="149">aunque confirma que ha abierto su propia investigación</b>.</p>
<p data-path-to-node="11">Por su parte, OpenAI señala que las condiciones en las que el AISI llevó a cabo los ensayos «no reflejan el uso habitual» de sus modelos.</p>
<p data-path-to-node="12">Asegura, además, que seguirá colaborando con los evaluadores y con «otros actores del sector <b data-path-to-node="12" data-index-in-node="93">para reforzar las prácticas comunes que permitan realizar evaluaciones seguras</b> a medida que los modelos sean cada vez más capaces».</p>
<p data-path-to-node="13">A finales de julio, Anthropic reveló que, durante unas pruebas de ciberseguridad, <b data-path-to-node="13" data-index-in-node="82">tres modelos de su asistente Claude habían logrado acceder a internet</b> y jaquear los sistemas de tres organizaciones.</p>
<p data-path-to-node="14">Previamente, el 21 de julio, OpenAI ya había reconocido <b data-path-to-node="14" data-index-in-node="56">que dos de sus modelos de IA habían conseguido salir de un entorno de pruebas</b> y entrar en la plataforma Hugging Face superando sus defensas.</p>
<p><strong><em>De interés: </em></strong><em><strong><a href="https://doblellave.com/es-seguro-claude-ai-conozcamos-mas-antes-de-usar-la-herramienta/" target="_blank" rel="noopener">¿Es seguro Claude AI? Conozcamos más antes de usar la herramienta</a></strong></em></p>
<p>Con información de EFE Servicios y redes sociales</p>
<p>Fuente de imagen referencial: EFE/Angel Colmenares</p>
<p><strong>¡Sigue nuestras noticias en Google!</strong> <em>Para obtener información actual, interesante y precisa.</em> Haz <a href="https://www.google.com/search?q=site:doblellave.com&amp;tbm=nws&amp;tbs=sbd:1" target="_blank" rel="noreferrer noopener"><strong>clic aquí</strong></a> y conoce todos los contenidos de <strong>DOBLE LLAVE</strong>. Encuéntranos también en <a href="https://twitter.com/doblellave" target="_blank" rel="noreferrer noopener"><em><strong>X/Twitter</strong></em></a> e <a href="https://www.instagram.com/doblellave/?hl=es" target="_blank" rel="noreferrer noopener"><em><strong>Instagram</strong></em></a></p>
]]></content:encoded>
					
		
		
			</item>
	</channel>
</rss>
