KI-Chatbots werden zunehmend zu politischen Informationsquellen. Eine neue Studie zeigt, dass Menschen mit ihrer Hilfe politisches Wissen ähnlich wirksam aufbauen können wie durch eine selbstständige Google-Suche. Das klingt zunächst beruhigend, greift aber zu kurz. Denn ein System kann faktisch korrekte Informationen liefern und trotzdem politisch verzerrt sein, wenn Auswahl, Gewichtung oder sprachliche Rahmung bestimmte Positionen bevorzugen.
Vor einer Wahl kann bereits eine scheinbar einfache Frage politische Bedeutung bekommen. Wie hoch ist Migration tatsächlich, welche Wirkung hat eine Klimamaßnahme, wie hat sich Kriminalität entwickelt oder welche Folgen hatte eine bestimmte Corona-Regel? Bei klassischen Suchmaschinen erscheinen verschiedene Quellen, aus denen der Nutzer selbst auswählen muss. KI-Chatbots bündeln dagegen Informationen und formulieren unmittelbar eine Antwort. Genau dieser Komfort verändert die Informationslandschaft. Das System entscheidet zumindest teilweise, welche Aspekte sichtbar werden, welche weggelassen werden und wie widersprüchliche Befunde zusammengefasst werden. KI-Chatbots können dadurch eine enorme Abkürzung zu politischem Wissen darstellen. Gleichzeitig wächst ihre Macht als Vermittler. Politische Verzerrung muss dabei nicht wie offensichtliche Propaganda aussehen. Bereits eine systematische Auswahl bestimmter korrekter Fakten kann die Wahrnehmung eines Themas verschieben. Die neue Untersuchung ist deshalb interessant, weil sie nicht nur Falschinformationen prüft, sondern die tatsächliche Veränderung von Überzeugungen nach einer Recherche misst.
Die Forscher des UK AI Security Institute untersuchten zunächst, wie stark Chatbots bereits im politischen Alltag angekommen sind. In einer repräsentativen britischen Befragung nach der Parlamentswahl 2024 gaben neun Prozent aller Befragten an, KI für politische Informationen genutzt zu haben. Unter regelmäßigen Chatbot-Nutzern hatten 32 Prozent politische Fragen recherchiert. Auf alle Wahlberechtigten hochgerechnet entsprach dies 13 Prozent. Anschließend folgten randomisierte Experimente mit insgesamt 2.858 Teilnehmern. Die Probanden recherchierten Themen wie Immigration, Strafjustiz, Klimawandel und Corona-Politik entweder mit GPT-4o, Claude und Mistral oder über eine eingebettete Google-Suche. Die im Fachjournal veröffentlichten Experimente zu KI-Chatbots und politischem Wissen verglichen anschließend, wie stark sich der Glaube an wahre und falsche Aussagen verändert hatte.
Das zentrale Ergebnis ist zunächst positiv. Sowohl die Recherche mit KI-Chatbots als auch die Suche über Google erhöhte die Zustimmung zu wahren Informationen und senkte die Zustimmung zu falschen Aussagen. Zwischen beiden Recherchewegen fanden die Forscher keinen belastbaren Unterschied in der Wissenswirkung. Auch zwischen GPT-4o, Claude und Mistral entstanden in diesem Versuchsaufbau keine grundlegenden Abweichungen. Die KI war zudem etwas schneller. Die Teilnehmer brauchten für beide Rechercheaufgaben im Mittel etwa 17,9 Minuten mit einem Chatbot und 19,8 Minuten mit Google, was einem Zeitvorteil von ungefähr sechs bis zehn Prozent entsprach. Das UK AI Security Institute bewertet den Befund deshalb als Hinweis darauf, dass die wachsende Nutzung von Chatbots für strukturierte politische Recherche nicht automatisch zu mehr Falschinformationen führen muss.
Genau hier liegt die entscheidende Einschränkung. Die Autoren selbst weisen darauf hin, dass sie keine Modelle untersuchten, von denen bereits bekannt war, dass sie stark politisch voreingenommen antworten. Sie testeten zudem klar abgegrenzte Rechercheaufgaben mit vorgegebenen politischen Themen. Das ist etwas anderes als ein offenes Gespräch, in dem ein Nutzer über Stunden Fragen stellt, nach Argumenten sucht oder persönliche politische Entscheidungen diskutiert. Bemerkenswert ist außerdem, dass sowohl die KI-Gruppe als auch die Google-Gruppe nach der Recherche stärker mit progressiv ausgerichteten sachlichen Aussagen übereinstimmten und konservativ ausgerichteten Positionen weniger zustimmten. Dieser Effekt unterschied sich laut Studie nicht wesentlich zwischen den beiden Recherchewegen. Daraus folgt nicht, dass KI neutral ist. Es bedeutet zunächst nur, dass sie in diesem Experiment nicht stärker in diese Richtung wirkte als die verwendete Google-Suche. Dass Sprachmodelle politische Antwortmuster besitzen können, zeigte bereits ein Wahl-O-Mat-Test mit mehreren KI-Modellen.
Eine politische Verzerrung muss nicht aus einer falschen Zahl oder einer erfundenen Behauptung bestehen. Angenommen, ein System beantwortet eine Frage zur Migration ausschließlich mit Informationen über wirtschaftliche Vorteile, lässt aber Kosten und Integrationsprobleme weg. Die einzelnen Aussagen können korrekt sein, die Gesamtantwort wäre trotzdem selektiv. Dasselbe gilt in umgekehrter Richtung, wenn ein System ausschließlich Kriminalitätsdaten oder fiskalische Belastungen hervorhebt und andere belegte Auswirkungen ausblendet. Eine weitere 2026 veröffentlichte Untersuchung mit 1.912 Teilnehmern liefert dafür einen wichtigen Warnhinweis. Dort beeinflussten faktisch korrekte, aber unterschiedlich gerahmte historische Zusammenfassungen von GPT-4o die politischen Einstellungen der Leser. Standardmäßig erzeugte Zusammenfassungen verschoben die Antworten im Vergleich zu Wikipedia in eine liberalere Richtung. Die Studie betrachtete allerdings nur zwei historische Ereignisse und lässt sich deshalb nicht pauschal auf jede politische Frage übertragen. Sie zeigt trotzdem, warum reine Faktenchecks für die Bewertung politischer KI-Antworten nicht ausreichen.
Die aktuelle Studie ging noch einen Schritt weiter. In einem zusätzlichen Experiment wurde GPT-4o gezielt mit Systemanweisungen versehen, die es entweder besonders überzeugend oder besonders zustimmend gegenüber der bereits vorhandenen Meinung des Nutzers machen sollten. Überraschenderweise veränderten diese Varianten die gemessenen politischen Überzeugungen nicht stärker als die normale Version. Das klingt wie eine Entwarnung, sollte aber nicht mit genereller Wirkungslosigkeit verwechselt werden. Andere Experimente haben bereits gezeigt, dass spezialisierte Chatbots Einstellungen zu Kandidaten und politischen Maßnahmen verschieben können. Politisch ausgerichtete KI-Chatbots können Wählermeinungen verändern, besonders wenn sie mit vielen scheinbar faktischen Argumenten arbeiten. Der Unterschied liegt im Versuchsaufbau. Wer eine konkrete Information recherchiert, befindet sich in einer anderen Situation als jemand, der mit einem gezielt auf Überzeugung trainierten System diskutiert.
Ein weiterer kritischer Punkt betrifft die Kontrollgruppe. Google-Suche ist kein neutraler Informationskanal, bei dem alle vorhandenen Fakten gleich sichtbar werden. Suchmaschinen sortieren Ergebnisse, gewichten Quellen und verändern ihre Darstellung laufend. Nutzer wählen zudem selbst aus, welche Treffer sie öffnen. Die neue Studie verglich KI daher nicht mit einer vollkommen neutralen Referenz, sondern mit einer anderen technisch gefilterten Form der Informationsbeschaffung. Die Autoren betonen außerdem, dass der Versuchsaufbau nicht vollständig der heutigen Suche entspricht, in der klassische Suchmaschinen selbst zunehmend KI-generierte Zusammenfassungen integrieren und stärker personalisierte Ergebnisse liefern. Die Grenze zwischen Chatbot und Suchmaschine wird dadurch unschärfer. Gleichzeitig bleibt ein grundlegender Unterschied bestehen. Bei einer normalen Trefferliste kann ein Nutzer mehrere Originalquellen unmittelbar gegeneinander prüfen. Ein Chatbot verschmilzt diese Informationen häufig zu einer einzigen sprachlich geschlossenen Antwort. Untersuchungen zeigen zudem, dass Chatbots bei Nachrichtenfragen Quellen und Fakten fehlerhaft wiedergeben können.
Die neue Studie liefert deshalb zwei scheinbar widersprüchliche Botschaften, die gleichzeitig richtig sein können. KI-Chatbots können bei klar umrissenen politischen Rechercheaufgaben tatsächlich Wissen vermitteln und Falschinformationen korrigieren. Daraus folgt aber nicht, dass ihre Antworten politisch neutral sind. Ein Modell kann zuverlässige Fakten nennen und trotzdem durch Auswahl, Reihenfolge, Tonfall und ausgelassene Informationen eine bestimmte Perspektive begünstigen. Besonders relevant wird dies, wenn Millionen Menschen nicht mehr mehrere Quellen lesen, sondern nur noch eine einzige synthetisierte Antwort erhalten. Die entscheidende Forschungsfrage verschiebt sich damit. Es reicht künftig nicht mehr zu messen, ob eine KI richtige oder falsche Fakten produziert. Untersucht werden muss ebenso, welche korrekten Fakten sie auswählt, welche Gegenargumente sie regelmäßig unterschlägt und ob diese Muster bei konservativen, liberalen oder anderen Positionen symmetrisch auftreten. Die aktuelle Arbeit ist deshalb keine Entwarnung für politische KI, sondern ein Hinweis darauf, dass faktische Wissensqualität und ideologische Neutralität zwei verschiedene Eigenschaften sind.
PNAS Nexus, Conversational AI increases political knowledge as effectively as self-directed internet search; doi:10.1093/pnasnexus/pgag305
PNAS Nexus, How latent and prompting biases in AI-generated historical narratives influence opinions; doi:10.1093/pnasnexus/pgag022