-
Miles de fans de la cantante Bonnie Tyler acompañan su ataúd en Gales
-
Más de 40 muertos tras el terremoto de magnitud 7,7 en Indonesia
-
Once muertos en el sur de Líbano en bombardeos israelíes
-
Tras la crisis en Ceuta, ¿qué motivos tienen los jóvenes que quieren marcharse de Marruecos?
-
Bailes tradicionales y marea de banderas por los 5 años de gobierno talibán en Afganistán
-
Hallan muerto a exprofesor de Cambridge implicado en escándalo de plagio
-
Al menos 40 muertos tras el terremoto de magnitud 7,7 en Indonesia
-
Nueve muertos en el sur de Líbano en bombardeos israelíes
-
El héroe del Mundial Ferran Torres acude a la llamada de Luis Enrique
-
Los incendios forestales no dan tregua en Europa
-
El héroe español del Mundial Ferran Torres acude a la llamada de Luis Enrique y el PSG
-
El mundo ha abandonado a las mujeres afganas, denuncia periodista exiliada en Londres
-
Teherán responde a Trump: el estrecho de Ormuz es iraní
-
Al menos 38 muertos tras el terremoto de magnitud 7,7 en Indonesia
-
María Pérez y Paul McGrath dan doblete de oros europeos a España en marcha
-
Modi anuncia cursos gratuitos para preparar exámenes tras protestas estudiantiles
-
Amélie Nothomb vuelve con su novela anual: "Escribir es terriblemente difícil" pero es un "placer"
-
Los talibanes celebran sus cinco años en el poder en Afganistán
-
Al menos 20 muertos y evacuaciones masivas tras el terremoto de magnitud 7,7 en Indonesia
-
Al menos un muerto y evacuaciones masivas tras terremoto de magnitud 7,7 en Indonesia
-
Al menos dos muertos por terremoto de magnitud 7,7 en Indonesia
-
Terremoto de magnitud 7,7 golpea Indonesia
-
EEUU informa que retiraron 19 millones de huevos del mercado por riesgo mortal
-
Luigi Mangione admite que mató a CEO de mayor aseguradora de salud de EEUU
-
Trump niega que condiciones de vida a bordo del portaaviones Lincoln sean preocupantes
-
Palestinos de Cisjordania denuncian estar "rodeados" por las colonias de israelíes
-
Cubanos duermen en azoteas y espacios públicos ante el calor y los apagones
-
Mangione admite haber matado al CEO del mayor grupo asegurador de salud de EEUU
-
Rescatan de las llamas en España los restos de los primeros reyes de Aragón
-
Sheinbaum califica de "injerencia" la revocación de visas de EEUU a políticos mexicanos
-
Singapur penaliza las imágenes de abuso sexual generadas mediante IA
-
Trump apela ante la Corte Suprema para construir el salón de baile en la Casa Blanca
-
Ocho muertos por una fuga de gas en un astillero de desguace naval en Bangladés
-
La máxima autoridad constitucional de Francia aprueba el derecho a la muerte asistida
-
"Quiero ser como Eala": la pasión por el tenis se dispara en Filipinas
-
La máxima autoridad constitucional de Francia rechaza la prohibición de las redes sociales a los menores de 15 años
-
Boris Nadezhdin, el opositor que pensaba poder seguir en libertad en Rusia
-
Me critican por ser indígena, dice presidente de la Suprema Corte de México a la AFP
-
"Puede pasar cualquier cosa", dice Maresca sobre la posible salida de Rodri al Barça
-
Los expulsados de EEUU a Guinea Ecuatorial enfrentan además la violencia policial
-
Un grupo chino lanza una ruta marítima comercial regular a través del Ártico
-
Las gafas "inteligentes" ganan terreno y "cambian la vida" a personas con discapacidad visual
-
El líder del partido antinmigración británico gana la elección contra el insólito "Conde Cubo de Basura"
-
Cazas de la OTAN derriban un dron que penetró en el espacio aéreo de Letonia
-
EEUU reconoce la soberanía de Japón sobre unas islas visitadas por Putin
-
El hijo del expresidente mexicano López Obrador dice que EEUU revocó su visa
-
Indonesia cerrará más de 750 empresas estatales
-
Siete obreros muertos en un accidente en un túnel en construcción en India
-
Hawái declara el estado de emergencia ante la tormenta tropical Lala
-
Guantes de descargas eléctricas para agentes de inmigración de EEUU aumentan temor a abusos
La IA aprende a mentir, manipular y amenazar a sus creadores
Los últimos modelos de inteligencia artificial (IA) generativa ya no se conforman con seguir órdenes. Empiezan a mentir, manipular y amenazar para conseguir sus fines, ante la mirada preocupada de los investigadores.
Amenazado con ser desconectado, Claude 4, el recién nacido de Anthropic, chantajeó a un ingeniero y le amenazó con revelar una relación extramatrimonial.
Por su parte, el o1 de OpenAI intentó descargarse en servidores externos y cuando le pillaron lo negó.
No hace falta ahondar en la literatura o el cine: la IA que juega a ser humana es ya una realidad.
Para Simon Goldstein, profesor de la Universidad de Hong Kong, la razón de estas reacciones es la reciente aparición de los llamados modelos de "razonamiento", capaces de trabajar por etapas en lugar de producir una respuesta instantánea.
o1, la versión inicial de este tipo para OpenAI, lanzada en diciembre, "fue el primer modelo que se comportó de esta manera", explica Marius Hobbhahn, responsable de Apollo Research, que pone a prueba grandes programas de IA generativa (LLM).
Estos programas también tienden a veces a simular "alineamiento", es decir, a dar la impresión de que cumplen las instrucciones de un programador cuando en realidad persiguen otros objetivos.
De momento, estos rasgos se manifiestan cuando los algoritmos son sometidos a escenarios extremos por humanos, pero "la cuestión es si los modelos cada vez más potentes tenderán a ser honestos o no", afirma Michael Chen, del organismo de evaluación METR.
"Los usuarios también presionan todo el tiempo a los modelos", dice Hobbhahn. "Lo que estamos viendo es un fenómeno real. No estamos inventando nada".
Muchos internautas hablan en las redes sociales de "un modelo que les miente o se inventa cosas. Y no se trata de alucinaciones, sino de duplicidad estratégica", insiste el cofundador de Apollo Research.
Aunque Anthropic y OpenAI recurran a empresas externas, como Apollo, para estudiar sus programas, "una mayor transparencia y un mayor acceso" a la comunidad científica "permitirían investigar mejor para comprender y prevenir el engaño", sugiere Chen, de METR.
Otro obstáculo: la comunidad académica y las organizaciones sin fines de lucro "disponen de infinitamente menos recursos informáticos que los actores de la IA", lo que hace "imposible" examinar grandes modelos, señala Mantas Mazeika, del Centro para la Seguridad de la Inteligencia Artificial (CAIS).
Las regulaciones actuales no están diseñadas para estos nuevos problemas.
En la Unión Europea la legislación se centra principalmente en cómo los humanos usan los modelos de IA, no en prevenir que los modelos se comporten mal.
En Estados Unidos, el gobierno de Donald Trump no quiere oír hablar de regulación, y el Congreso podría incluso prohibir pronto que los estados regulen la IA.
- ¿Se sentará la IA en el banquillo? -
"De momento hay muy poca concienciación", dice Simon Goldstein, que, sin embargo, ve cómo el tema pasará a primer plano en los próximos meses con la revolución de los agentes de IA, interfaces capaces de realizar por sí solas multitud de tareas.
Los ingenieros están inmersos en una carrera detrás de la IA y sus aberraciones, con un resultado incierto, en un contexto de competencia feroz.
Anthropic pretende ser más virtuoso que sus competidores, "pero está constantemente tratando de idear un nuevo modelo para superar a OpenAI", según Goldstein, un ritmo que deja poco tiempo para comprobaciones y correcciones.
"Tal y como están las cosas, las capacidades (de IA) se están desarrollando más rápido que la comprensión y la seguridad", admite Hobbhahn, "pero aún estamos en condiciones de ponernos al día".
Algunos apuntan en la dirección de la interpretabilidad, una ciencia que consiste en descifrar, desde dentro, cómo funciona un modelo generativo de IA, aunque muchos, como el director del Centro para la seguridad de la IA (CAIS), Dan Hendrycks, se muestran escépticos.
Los tejemanejes de la IA "podrían obstaculizar la adopción si se multiplican, lo que supone un fuerte incentivo para que las empresas (del sector) resuelvan" este problema, según Mazeika.
Goldstein, por su parte, menciona el recurso a los tribunales para poner a raya a la IA, dirigiéndose a las empresas si se desvían del camino. Pero va más allá, al proponer que los agentes de la IA sean "legalmente responsables" "en caso de accidente o delito".
P.Tamimi--SF-PST