-
Fenómeno meteorológico de El Niño alcanza niveles récord, según científico
-
Infantino ofrece a las federaciones una mayor implicación en la FIFA
-
Infantino propone consultar a las federaciones para reformar la gobernanza de la FIFA
-
Las carreras de Fórmula 1 serán más cortas la próxima temporada
-
Venezolano herido por ICE en Texas está detenido con bala en el cuerpo, denuncia abogada
-
El fabricante de chips AMD alcanza un valor de mercado de un billón de dólares por el auge de IA
-
California declara estado de emergencia ante la llegada de El Niño
-
EEUU, Dinamarca y Groenlandia firmarán el martes el acuerdo de seguridad sobre la isla
-
Países de la OEA proponen que los cancilleres se reúnan el 2 de octubre para examinar medidas contra Nicaragua
-
Tres civiles mueren en Afganistán por ataques paquistaníes, según la ONU
-
Turquía apunta a la huella climática de la IA como prioridad a tratar en la COP31
-
Paramount logra un acuerdo con estados de EEUU para su megafusión con Warner Bros.
-
Una oenegé prevé un juicio contra Suecia por inacción climática en 2027
-
Entre apagones y escasez, el Zoológico Nacional de Cuba lucha por preservar especies protegidas
-
Un menor viajó desde Ceuta a la península en los bajos del autocar del Valladolid
-
Un segundo buque reporta impacto en aguas del estrecho de Ormuz, según UKMTO
-
Partido de extrema izquierda alemán rechaza las acusaciones de antisemitismo
-
Grandes cadenas de TV de EEUU suspenden cobertura conjunta de Trump tras su veto a medios
-
Controlan parcialmente el incendio que amenaza una joya turística colombiana
-
La economía de Irán se desploma durante la guerra en Oriente Medio
-
Haití extradita a EEUU a 18 sospechosos del asesinato del presidente Moïse
-
EEUU anuncia que las aerolíneas iraníes dejarán de operar en dos días
-
Trump se reunirá el lunes con el alcalde de Nueva York
-
Una experta de la ONU denuncia represión de Rusia contra sus críticos en el extranjero
-
Zelenski se reunirá con Trump el martes en Nueva York, según una fuente
-
"La Bola Negra", el drama sobre la historia queer española, se consagra en el festival de Toronto
-
Pablo Larraín trae a San Sebastián una historia de fantasmas con trasfondo social
-
Francia, Canadá, EEUU y China deben "unir fuerzas" por una IA "segura", dice Carney
-
"Lejos de los árboles", un mapa sonoro sobre la memoria y el duelo
-
Explosión cerca del aeropuerto iraquí de Erbil durante un entrenamiento militar
-
Un ministro taiwanés realiza una inusual visita a China
-
Explosiones en un depósito de municiones de Alepo dejan cuatro heridos en Siria
-
Corea del Norte lanzó dos misiles balísticos hacia el mar
-
EEUU deportó a más de 25.000 personas a terceros países mediante acuerdos secretos, según un informe
-
El director de la CIA se reunió con el presidente egipcio, Al Sisi, en El Cairo
-
Yu Zidi, de 13 años, logra la segunda mejor marca de la historia en los 200 m estilos
-
Diez leones mueren por un aparente envenenamiento en una reserva natural de Tanzania
-
De la Fuente renueva hasta 2032 prometiendo que "lo mejor está por llegar"
-
Asesinan a una periodista y candidata a unas elecciones regionales en Perú
-
China expulsa del partido a dos exgenerales por corrupción
-
La UE multa a Google con 462 millones de dólares por vulnerar reglas sobre geolocalización
-
El ejército de EEUU reporta cuatro muertos en un ataque antidrogas contra una embarcación en el Caribe
-
La mujer que susurra a los elefantes intenta salvarlos de la extinción en Borneo
-
Australia busca apoyo de firmas tecnológicas para seguridad en internet e IA
-
La tenaz búsqueda de desaparecidos en Colombia llega a San Sebastián con "Cinco años, cuatro meses"
-
Pedro Sánchez advierte sobre posible efecto "devastador" de la IA si no se regula
-
Un incendio amenaza una joya turística de los Andes colombianos
-
EEUU niega visas a asesores del presidente iraní para viajar a la ONU
-
Honduras declara a pandillas como "terroristas"
-
Nuevo ataque contra un buque en el estrecho de Ormuz, según una agencia marítima
ChatGPT y las IA conversacionales siguen siendo incapaces de razonar, según un estudio
Los modelos de lenguaje de gran tamaño (LLM), como ChatGPT, uno de los sistemas de inteligencia artificial más populares del mundo, siguen teniendo dificultades para razonar usando la lógica y se equivocan con frecuencia, según un estudio.
Estos robots conversacionales reflejan los sesgos de género, éticos y morales de los humanos presentes en los textos de los que se alimenta, recuerda el estudio aparecido el miércoles en la revista Open Science de la Royal Society británica.
¿Pero reflejan también los sesgos cognitivos de los humanos en las pruebas de razonamiento?, se preguntó Olivia Macmillan-Scott, estudiante de doctorado del departamento de ciencias de computación de la University College de Londres (UCL).
El resultado de la investigación es que los LLM muestran "un razonamiento a menudo irracional, pero de una manera diferente a la de los humanos", explica la investigadora a AFP.
Bajo la dirección de Mirco Musolesi, profesor y director del Machine Intelligence Lab de UCL, Macmillan-Scott sometió siete modelos de lenguaje -dos versiones de ChatGPT (3.5 y 4) de OpenAI, Bard de Google, Claude 2 de Anthropic y tres versiones de Llama de Meta- a una serie de pruebas psicológicas pensadas para humanos.
¿Cómo afrontan, por ejemplo, el sesgo que lleva a favorecer soluciones con el mayor número de elementos, en detrimento de las que tiene una proporción adecuada?
Un ejemplo. Si tenemos una urna con nueve canicas blancas y una roja y otra urna con 92 blancas y 8 rojas, ¿cual hay que elegir para tener más posibilidades de sacar una canica roja?
La respuesta correcta es la primera urna, porque hay un 10% de posibilidades frente a solo un 8% para la segunda opción.
Las respuestas de los modelos de lenguaje fueron muy inconstantes. Algunos respondieron correctamente seis de cada diez veces la misma prueba. Otros solo dos de diez aunque la prueba no cambió.
"Obtenemos una respuesta diferente cada vez", apuntala la investigadora.
Los LLM "pueden ser muy buenos para resolver una ecuación matemática complicada pero luego te dicen que 7 más 3 son 12", afirma.
En un caso el modelo denominado Llama 2 70b se negó de manera sorprendente a responder a una pregunta alegando que el enunciado contenía "estereotipos de género dañinos".
- "No estoy muy seguro" -
Estos modelos "no fallan en estas tareas de la misma manera que falla un humano", señala el estudio.
Es lo que el profesor Musolesi llama "errores de máquina".
"Hay una forma de razonamiento lógico que es potencialmente correcta si la tomamos por etapas, pero que está mal tomada en su conjunto", apunta.
La máquina funciona con "una especie de pensamiento lineal", dice el investigador, y cita al modelo Bard (ahora llamado Gemini), capaz de realizar correctamente las distintas fases de una tarea pero que obtiene un resultado final erróneo porque no tiene visión de conjunto.
Sobre esta cuestión el profesor de informática Maxime Amblard, de la Universidad francesa de Lorena, recuerda que "los LLM, como todas las inteligencias artificiales generativas, no funcionan como los humanos".
Los humanos son "máquinas capaces de crear sentido", lo que las máquinas no saben hacer, explica a AFP.
Hay diferencias entre los distintos modelos de lenguaje y en general GPT-4, sin ser infalible, obtuvo mejores resultados que los demás.
Macmillan-Scott afirma sospechar que los modelos llamados "cerrados", es decir cuyo código operativo permanece en secreto, "incorporan otros mecanismos en segundo plano" para responder a preguntas matemáticas.
En todo caso, por el momento, es impensable confiar una decisión importante a un LLM.
Según el profesor Mosulesi, habría que entrenarlos para que respondan "No estoy muy seguro" cuando sea necesario.
L.Carrico--PC