-
Trump acapara focos de la insólita carrera de autos en las calles de Washington
-
Carney opta por hacer frente a Trump, a pesar de los peligros
-
Canadá responde con aranceles tras fracaso de negociaciones comerciales con EEUU
-
Trece muertos en Ucrania y Rusia por nuevos ataques
-
Un barco surcoreano se lanza por la ruta marítima del Ártico
-
Buscan desaparecidos tras ataque ruso a un centro comercial ucraniano que dejó 16 muertos
-
Madonna, Justin Bieber y el "efecto Odisea": el verano griego de la jet set norteamericana
-
Un barco surcoreano listo para adentrarse en la ruta marítima del Ártico
-
EEUU y Canadá fracasan en su negociación y entran en vigor nuevos aranceles del 50%
-
El tren a ninguna parte, un símbolo del esfuerzo de Corea del Sur para aproximarse al Norte
-
EEUU y Canadá fracasan en un acuerdo y entran en vigor nuevos aranceles del 50%
-
Lula llama a Trump y lo insta a dialogar sobre los aranceles
-
Un muerto y tres heridos deja ataque con espada en una escuela de Suecia
-
Russell saldrá desde la pole en la carrera esprint en Países Bajos
-
Fuerte castigo de la FIFA a Argentina por incidentes en el Mundial
-
Bajo presión antes de las legislativas, Trump reduce aranceles a la carne
-
Al menos tres heridos en un ataque con espada en una escuela de Suecia
-
Turquía emite una orden de arresto internacional contra Netanyahu por la detención de activistas para Gaza
-
Russell saldrá de la pole en la carrera esprint del GP de Países Bajos
-
Sinner renuncia al US Open por problemas en una rodilla
-
Varias personas heridas a espadazos en una escuela de Suecia
-
Guillermo y Enrique, una reconciliación que parece improbable a corto plazo
-
El príncipe Enrique y otros famosos deberán pagar casi 13 millones de dólares al Daily Mail
-
El príncipe Enrique y otras celebridades deberán pagar casi 13 millones de dólares al Daily Mail
-
El presidente de Irán aboga por poner fin a la guerra ahora que están "en posición de fuerza"
-
Presidente de Irán aboga por poner fin a la guerra ahora que están "en posición de fuerza"
-
Antonelli (Mercedes), el más rápido en los únicos libres en Zandvoort
-
El presidente de Irán aboga por poner fin a la guerra ahora que Teherán está "en posición de fuerza"
-
El bitcóin se dispara impulsado por el proyecto de ley sobre criptomonedas en EEUU
-
Pogacar a por La Vuelta, la última grande que le falta
-
La presidenta de la CPI alerta de la "desaparición del Estado de derecho internacional" por las sanciones de EEUU
-
La epidemia de ébola en RD Congo "avanza de forma exponencial", según la ONU
-
La policía española detiene a traficantes que transportaban a migrantes de Ceuta a la península
-
Justicia india ordena nuevas medidas para proteger a los elefantes
-
Cinco desaparecidos y 19 heridos en dos incendios en edificios de Suiza
-
Milei afirma que la "locura" del aborto legal en Argentina está "costando caro"
-
Japón ejecuta al autor de un incendio mortal en 2009
-
Dos mexicanos detenidos en el desmantelamiento de un laboratorio de drogas en Sudáfrica
-
Las consecuencias globales de un fenómeno de El Niño récord
-
Capitán indio detenido en Londres por transportar petróleo ruso es un "chivo expiatorio", dice su esposa
-
El saldo de muertos por inundaciones en el sur de China asciende a 159, según la prensa estatal
-
Un sismo de magnitud 6,7 sacude el sur de Perú y causa tres lesionados
-
Nueva votación para elegir al próximo jefe de la ONU, puesto que reclama América Latina
-
Ex primer ministro pakistaní regresa a prisión tras examen en el hospital
-
Activistas de vigilias por Tiananmén declarados culpables en Hong Kong de incitar a la subversión
-
El auge de la energía solar en China disminuye la diversidad de aves, según estudio
-
Canal de Panamá reducirá tránsito de buques por el fenómeno de El Niño
-
Líder kurdo dice que completó proceso de integración con el Estado sirio
-
"Escuché que me extrañaron": Melania Trump en su primera aparición pública en un mes
-
Trasladan a un hospital a ex primer ministro pakistaní por orden del Tribunal Supremo
ChatGPT y las IA conversacionales siguen siendo incapaces de razonar, según un estudio
Los modelos de lenguaje de gran tamaño (LLM), como ChatGPT, uno de los sistemas de inteligencia artificial más populares del mundo, siguen teniendo dificultades para razonar usando la lógica y se equivocan con frecuencia, según un estudio.
Estos robots conversacionales reflejan los sesgos de género, éticos y morales de los humanos presentes en los textos de los que se alimenta, recuerda el estudio aparecido el miércoles en la revista Open Science de la Royal Society británica.
¿Pero reflejan también los sesgos cognitivos de los humanos en las pruebas de razonamiento?, se preguntó Olivia Macmillan-Scott, estudiante de doctorado del departamento de ciencias de computación de la University College de Londres (UCL).
El resultado de la investigación es que los LLM muestran "un razonamiento a menudo irracional, pero de una manera diferente a la de los humanos", explica la investigadora a AFP.
Bajo la dirección de Mirco Musolesi, profesor y director del Machine Intelligence Lab de UCL, Macmillan-Scott sometió siete modelos de lenguaje -dos versiones de ChatGPT (3.5 y 4) de OpenAI, Bard de Google, Claude 2 de Anthropic y tres versiones de Llama de Meta- a una serie de pruebas psicológicas pensadas para humanos.
¿Cómo afrontan, por ejemplo, el sesgo que lleva a favorecer soluciones con el mayor número de elementos, en detrimento de las que tiene una proporción adecuada?
Un ejemplo. Si tenemos una urna con nueve canicas blancas y una roja y otra urna con 92 blancas y 8 rojas, ¿cual hay que elegir para tener más posibilidades de sacar una canica roja?
La respuesta correcta es la primera urna, porque hay un 10% de posibilidades frente a solo un 8% para la segunda opción.
Las respuestas de los modelos de lenguaje fueron muy inconstantes. Algunos respondieron correctamente seis de cada diez veces la misma prueba. Otros solo dos de diez aunque la prueba no cambió.
"Obtenemos una respuesta diferente cada vez", apuntala la investigadora.
Los LLM "pueden ser muy buenos para resolver una ecuación matemática complicada pero luego te dicen que 7 más 3 son 12", afirma.
En un caso el modelo denominado Llama 2 70b se negó de manera sorprendente a responder a una pregunta alegando que el enunciado contenía "estereotipos de género dañinos".
- "No estoy muy seguro" -
Estos modelos "no fallan en estas tareas de la misma manera que falla un humano", señala el estudio.
Es lo que el profesor Musolesi llama "errores de máquina".
"Hay una forma de razonamiento lógico que es potencialmente correcta si la tomamos por etapas, pero que está mal tomada en su conjunto", apunta.
La máquina funciona con "una especie de pensamiento lineal", dice el investigador, y cita al modelo Bard (ahora llamado Gemini), capaz de realizar correctamente las distintas fases de una tarea pero que obtiene un resultado final erróneo porque no tiene visión de conjunto.
Sobre esta cuestión el profesor de informática Maxime Amblard, de la Universidad francesa de Lorena, recuerda que "los LLM, como todas las inteligencias artificiales generativas, no funcionan como los humanos".
Los humanos son "máquinas capaces de crear sentido", lo que las máquinas no saben hacer, explica a AFP.
Hay diferencias entre los distintos modelos de lenguaje y en general GPT-4, sin ser infalible, obtuvo mejores resultados que los demás.
Macmillan-Scott afirma sospechar que los modelos llamados "cerrados", es decir cuyo código operativo permanece en secreto, "incorporan otros mecanismos en segundo plano" para responder a preguntas matemáticas.
En todo caso, por el momento, es impensable confiar una decisión importante a un LLM.
Según el profesor Mosulesi, habría que entrenarlos para que respondan "No estoy muy seguro" cuando sea necesario.
G.AbuGhazaleh--SF-PST