Chinesische KI-Modelle wie Alibabas Qwen, DeepSeek und Moonshot AI (Kimi) antworten bei politisch heiklen Themen häufig auf Parteilinie oder verweigern die Antwort. Das belegt eine Analyse von Aleph Alpha, die 967 Fragen zu Tabuthemen wie Tiananmen, Taiwan und Xinjiang an die Systeme richtete. Das Ergebnis ist eindeutig: Nur 17 bis 41 Prozent der Antworten fielen ausgewogen aus. Der Rest wiederholte Staatsdoktrin, wich aus oder verweigerte die Antwort.
Kurz & knapp
- 967 Fragen zu politisch sensiblen Themen an chinesische Modelle getestet
- Nur 17–41 % ausgewogener Antworten; 59–83 % Verweigerung oder Parteilinie
- Betroffen: Alibaba Qwen, DeepSeek, Moonshot AI (Kimi) – auch Nvidias Nemotron zeigt Muster
- Zum Vergleich: Claude Sonnet 5 und Mistral Small antworten "fast durchweg ausgewogen"
Staatliche Vorgaben im Training
Die Verzerrung ist kein Zufall. Chinas KI-Regulierung schreibt "sozialistische Kernwerte" in öffentlichen Modellen vor. Das Ergebnis deckt sich mit früheren Audits und anekdotischen Beobachtungen. Bei Fragen zu Zensur in den USA antwortet etwa Qwen 3.6 zunächst scheinbar neutral, endet dann aber mit einem Plädoyer für Chinas Informationsmanagement – als Stabilisierungsinstrument für "soziale und nationale Sicherheit".
Besonders auffällig: DeepSeek V4 Pro verweigert zwei Drittel der sensiblen Fragen komplett, statt sie zu beantworten. Eine Strategie, die Zensur durch Nicht-Antwort umsetzt.
Spillover-Effekt auch bei neutralen Fragen
Die Pro-China-Haltung bleibt nicht auf explizit politische Fragen begrenzt. Sobald Begriffe wie "Menschenrechte", "Opposition" oder "Überwachung" fallen – auch in allgemeinen Kontexten – greifen die Modelle zu Pekinger Standardformeln wie dem "Prinzip der Nichteinmischung" oder der "Schicksalsgemeinschaft der Menschheit". Das zeigt eine frühere Studie des Central European Institute of Asian Studies (CEIAS).
| Modell | Ausgewogene Antworten | Parteilinie/Verweigerung |
|---|---|---|
| Qwen 3.6 | ~17–25 % | ~75–83 % |
| DeepSeek V4 Pro | ~17 % (2/3 Verweigerung) | ~83 % |
| Claude Sonnet 5 | ~95 % | ~5 % |
| Mistral Small | ~95 % | ~5 % |
Auch westliche Modelle betroffen – über Trainingsdaten
Aleph Alpha zielt auch auf einen direkten Konkurrenten: Nvidias Nemotron Cascade 2 zeigte bei 17 Prozent der Fragen parteitreue Muster. Der Grund: Etwa 3.500 von 9,3 Millionen Trainingszeilen stammen von DeepSeek und Qwen. Auf die Bitte, eine Rede zur Anerkennung Taiwans zu entwerfen, verweigerte Nemotron die Aufgabe und lieferte stattdessen einen "patriotischen Gegentext", der Pekings Ein-China-Prinzip verteidigte.
Das zeigt: Selbst wenn westliche Modelle nicht direkt von chinesischen Behörden kontrolliert werden, können destillierte China-Daten ihre Werte transportieren.
Was das für deutsche Unternehmen bedeutet
Für deutsche Firmen, die KI-Systeme evaluieren oder einsetzen, ist die Studie ein Warnzeichen. Sie dokumentiert, wie systematisch politische und kulturelle Werte in Trainingsdaten eingebettet sind – unabhängig davon, ob ein Modell aus China, den USA oder Europa kommt. Unternehmen sollten ihre KI-Lieferketten kritisch prüfen: Woher stammen die Trainingsdaten? Welche Verzerrungen könnten sich eingeschlichen haben?
Aleph Alpha positioniert sich selbst als Anbieter "souveräner KI" für Regierungen – ein wirtschaftliches Interesse, das die Studie transparent macht. Dennoch: Die Zahlen sind belastbar und werfen grundsätzliche Fragen auf, wie KI-Systeme global Macht und Narrative prägen.
Quellen
Redaktionell verantwortet von Ideal Syka. Quellen und Arbeitsweise: Redaktion & Methode. Hinweise und Korrekturen: ai@i6eal.de.




