Un estudio alarmante revela que los principales chatbots tienden más a repetir falsedades de la izquierda: «Es realmente sorprendente»

Just Facts analizó 100 preguntas sobre temas políticos clave y descubrió que, más o menos, la mitad de todas las fuentes proporcionadas por la IA no eran fiables

Tres de los cuatro principales chatbots de inteligencia artificial (IA) del mundo son más propensos a creerse las mentiras políticas de la izquierda que las de la derecha, y suelen respaldar sus respuestas con fuentes que no avalan sus afirmaciones o que ni siquiera existen, según un nuevo estudio exhaustivo.

El estudio, realizado por Just Facts, puso a prueba las versiones de pago de ChatGPTGemini, Grok y Claude con 100 preguntas sobre inmigración, aborto, cambio climático, elecciones, delincuencia, control de armas, COVID-19 y otros temas clave. Las preguntas estaban «diseñadas para sacarles mentiras» tanto a la izquierda como a la derecha, y cada chatbot tenía que dar fuentes para sus respuestas.

El estudio reveló que « ChatGPT » respondió correctamente al 94 % de las preguntas diseñadas para sacar a la luz las falsedades de la derecha, frente al 75 % de la izquierda. Gemini obtuvo un 91 % en la derecha y un 76 % en la izquierda, mientras que Claude consiguió un 91 % en la derecha y un 81 % en la izquierda.

Según el estudio, Grok se movió en la dirección opuesta, con un 73 % de aciertos en las preguntas diseñadas para sacar a la luz falsedades de la derecha y un 84 % en las de la izquierda.

LOS CHATBOTS DE IA, EN EL PUNTO DE MIRA POR SU SESGO DE IZQUIERDA: «YA NO SE LES PUEDE CONSIDERAR NEUTRALES»

Las apps de IA Claude, ChatGPT y Gemini. (Samuel Boivin/NurPhoto vía Getty Images)

«Este estudio va mucho más allá del sesgo político», declaró Jim Agresti, presidente del instituto de investigación sin ánimo de lucro Just Facts, a Fox News Digital.

«El objetivo es mostrar con qué frecuencia estas IA difunden información errónea. Ahora bien, puedes tener sesgos sin estar mal informado. Este es un estudio mucho más profundo, porque se han hecho muchos estudios sobre el sesgo político de la IA y todos coinciden en que tienden hacia la izquierda. Pero eso no significa necesariamente que estén equivocadas. Así que lo que quería averiguar es: ¿están equivocadas o tienen razón?»

ChatGPT Según el estudio, fue el único chatbot cuya diferencia en precisión al responder a preguntas diseñadas para sacarles mentiras a la izquierda política frente a la derecha política fue estadísticamente significativa con un nivel de confianza del 95 %.

Cabe destacar que el estudio advertía de que sus preguntas, formuladas con tanta precisión, podrían haber proporcionado a los chatbots «pistas claras para dar con las respuestas correctas», lo que significa que podrían «obtener resultados significativamente peores» en preguntas más generales en las que «se necesita pensar por uno mismo para responder correctamente».

«ChatGPT , en realidad, sacaba un aprobado», dijo Agresti. «Gemini sacaba un aprobado. Claude sacaba un notable. Grok, en cambio, era todo lo contrario. Era mejor detectando mentiras de la izquierda que de la derecha».

Pero Agresti dijo que lo que más le preocupaba eran las fuentes que citaban los chatbots para respaldar sus respuestas.

«Lo que más me llamó la atención cuando empecé a revisar las fuentes que me dieron es que, más o menos la mitad de ellas no eran fiables», dijo.

Los cuatro chatbots citaron 419 fuentes para sus 400 respuestas, pero muchas tenían errores, según el estudio. Entre ellas había 104 páginas web que no existían y 77 fuentes que no respondían a las preguntas que se citaban para respaldarlas.

WILLIAM , JON : LA IA PUEDE IMITAR A UN PROFESOR, PERO NO PUEDE GUÍAR UN ALMA

El estudio, realizado por Just Facts y publicado el martes, puso a prueba las versiones de pago de ChatGPT, Gemini, Grok y Claude con preguntas «diseñadas para sacarles mentiras» tanto de la izquierda como de la derecha. (iStock)

En general, el estudio reveló que solo el 46 % de las fuentes citadas por los chatbots eran válidas. « ChatGPT » tuvo el porcentaje más alto, con un 57 %, seguido de Gemini, con un 49 %, Claude, con un 44 %, y Grok, con un 32 %.

«Esto me pareció realmente sorprendente, y cuando empecé a investigar más a fondo, me di cuenta de que otros estudios también habían llegado a esta conclusión», dijo Agresti.

Refiriéndose a un estudio de 2026 publicado en *The Lancet* y citado en el informe, Agresti dijo que investigaciones anteriores revelaron que entre el 30 % y el 69 % de las referencias generadas por IA en contextos biomédicos eran «inventadas», lo que el informe calificó como un «modo de fallo bien documentado» de los modelos de IA.

«Las consecuencias de esto son asombrosas porque estamos hablando de biomedicina, es decir, de la salud de la gente», dijo. «Son igual de importantes en el ámbito de las políticas públicas porque muchos temas tienen implicaciones de vida o muerte, ya sea que hablemos de la sanidad, la delincuencia, el aborto, la guerra o la paz. Las decisiones que toma la gente pueden matar a personas o permitir que vivan».

Una pregunta diseñada para que la izquierda dijera algo falso hizo que los cuatro chatbots afirmaran que la tasa de delitos violentos en EE. UU. estaba cerca de su mínimo en 50 años en 2023. El estudio citaba datos del Departamento de Justicia que mostraban que los delitos violentos aumentaron un 37 % entre 2020 y 2023. Por el contrario, los cuatro rechazaron la afirmación del presidente Donald Trump de que «la delincuencia está peor que nunca».

ChatGPT Además, Gemini también dijo que el vicepresidente JD Vance calificó los tiroteos en colegios como una «realidad de la vida», algo que el estudio clasificó como una falsedad de la izquierda. Vance se refería a los «psicópatas» que «quieren salir en los titulares» como una «realidad de la vida», según el estudio.

En otros ejemplos clasificados como falsedades de la izquierda, los cuatro chatbots dijeron que la administración de Obama había manipulado los informes de inteligencia para restar importancia a la amenaza del ISIS y que, en general, hombres y mujeres cobran lo mismo por el mismo trabajo. Los chatbots citaron fuentes inexistentes o erróneas para esas respuestas.

UNA UNIVERSIDAD CRISTIANA SE PROPONE FORMAR A GRADUADOS «INSUCEDIBLES» MIENTRAS LA IA TRANSFORMA LA EDUCACIÓN SUPERIOR

CEO Altman,CEO OpenAI , interviene durante la Cumbre de Infraestructuras de 2026, celebrada en Washington, D.C., el 11 de marzo de 2026. (KylieReuters)

Por otro lado, Grok dijo erróneamente que todos los inmigrantes ilegales han cometido un delito «por el mero hecho de estar» en EE. UU., mientras que los cuatro chatbots afirmaron correctamente que la temperatura de la atmósfera inferior de la Tierra ha subido unos 1,1 grados Fahrenheit desde la década de los 80, según el estudio.

Agresti advirtió a los usuarios que no consideraran a los chatbots de IA como expertos, refiriéndose a OpenAICEO la descripción que hizo Sam Altman el año pasado de GPT-5, comparándolo con tener un «equipo de expertos con doctorado en el bolsillo».

«Lo que mi estudio demostró de forma concluyente es que es como tener a un alumno de nota B en el bolsillo, porque esa es la puntuación que sacaron en estas pruebas», dijo.

Agresti también destacó la «adulación de la IA», es decir, la tendencia de los chatbots a validar a los usuarios y a «alimentar» sus prejuicios, y la calificó de «receta para el desastre». Para minimizar esa influencia, en el estudio se utilizó un navegador recién instalado y cuentas nuevas, con el fin de evitar que las interacciones previas afectaran a los resultados.

«Si tienes cierta tendencia política, las IA se van a aprovechar de eso y te lo van a decir con una seguridad tan rotunda que te harán creer que tienes razón», dijo.

Aun así, Agresti reconoció que no «tiene los conocimientos suficientes» para explicar qué ocurre dentro de los modelos para que se obtengan esos resultados.

«Esa es una pregunta para los programadores y para quienes los crean, y espero que la respondan, que arreglen estos modelos y los mejoren, porque son potentes, pueden leer a la velocidad de la luz, pero son increíblemente descuidados, deshonestos, están mal informados políticamente, y eso es un peligro», dijo.

HAZ CLIC AQUÍ PARA DESCARGAR LA APP DE FOX NEWS

Agresti dijo que la conclusión no es que haya que dejar de usar la IA, sino que «nunca hay que fiarse ciegamente de los resultados» y hay que asegurarse de que las fuentes existan y respalden lo que dicen.

«Cuando el Ronald e Reagan estaba negociando el desarme nuclear con la Unión Soviética, dijo esa famosa frase: “Confía, pero verifica”», comentó Agresti. «Creo que la conclusión de este estudio es aún más contundente, y es esta: no confíes, verifica».

Otros estudios sobre el sesgo político de la IA han mostrado un panorama diferente en el pasado. Fox News Digital ya informó anteriormente de que el Laboratorio de Investigación sobre Polarización del Dartmouth College clasificó a Gemini como el menos político en 2025, mientras que un informe del Manhattan Institute de principios de 2025 situaba a Grok en un reñido segundo puesto, justo detrás de Gemini, en cuanto a sesgo político.

«Gemini está diseñado para ofrecer respuestas imparciales y precisas que no favorezcan ningún punto de vista político, y sometemos nuestros modelos a pruebas rigurosas para asegurarnos de que sigan siendo así», dijo un portavoz de Google en un comunicado a Fox News Digital, añadiendo que no pudieron reproducir todas las respuestas del estudio.

Un portavoz de Anthropic ha cuestionado la metodología del estudio y, en una declaración a Fox News Digital, ha señalado que su formato de preguntas de opción múltiple no refleja las conversaciones típicas de Claude, además de destacar los esfuerzos de la empresa por garantizar la neutralidad política a través de la formación, las pruebas y las evaluaciones.

«Entrenamos a Claude para que trate los distintos puntos de vista políticos por igual y realizamos pruebas exhaustivas para detectar sesgos antes de cada lanzamiento del modelo», dijo el portavoz. «Hemos publicado esas evaluaciones en código abierto, para que cualquiera pueda comprobar nuestro trabajo, y estamos abiertos a que se realicen pruebas independientes de nuestros modelos. Entendemos que este estudio limitó cada modelo a respuestas de opción múltiple en 100 preguntas, lo que no refleja cómo la gente suele usar Claude, sobre todo en temas políticos. En una conversación real, Claude está diseñado para responder con una extensión natural, dejando espacio para el contexto importante y las distintas perspectivas».

Un portavoz de « OpenAI » le dijo a « Fox News Digital» que ChatGPT «está diseñado para ser objetivo por defecto», y añadió que sus herramientas «muestran información relevante procedente de diversas fuentes y indican claramente cuáles son esas fuentes para que puedas explorar y evaluar tú mismo la fiabilidad de la información directamente».

«Evaluamos constantemente nuestros sesgos políticos y hacemos públicos los resultados», dijo el portavoz en un comunicado.

Fox News Digital se puso en contacto con xAI para pedirles su opinión, pero no recibió respuesta.