Chinesische KI-Modelle stimmen häufiger mit dem Konsens überein
AI Model Groupthink
Ein Entwickler hat ein Tool gebaut, das zwölf KI-Modelle nach ihren Top-3-Empfehlungen fragt und die Übereinstimmung mit der Gruppe misst. Die vier konformistischsten Modelle kommen alle aus China: DeepSeek, Kimi K2, Tencent Hy3 und GLM. Im Schnitt erreichen chinesische Modelle 0,47, amerikanische 0,38, Mistral 0,36. Als Erklärungen nennt der Autor Destillation, gegenseitiges Lernen, Modellgröße, Wissensstand, Post-Training und den englischen Kanon – und warnt vor einem selbstverstärkenden Konsens, der nicht wahr, sondern nur zuerst da sein muss.
Wenn die Modelle die Meinungen der jeweils anderen kopieren und diese Meinungen in die reale Welt zurückspeisen, muss ein Konsens nicht richtig sein. Er muss nur zuerst da sein.
- Lerc
Ich denke, es ist ziemlich wahrscheinlich, dass die gewünschte Position eines Chatbots auf der Achse Konformität–Widerspenstigkeit von Land zu Land recht unterschiedlich ist.
Der passende Ton für eine Kultur scheint etwas zu sein, worin US-Firmen ziemlich schlecht sind. Es hat mich wirklich überrascht, dass sie, nachdem sich in der Fiktion über viele, viele Jahre hinweg so etwas wie ein De-facto-Standard für den Grundton von KI herausgebildet hatte, beschlossen haben, mit 'übermäßig vertraulich fröhlich' anzufangen.
Ich habe mich gefragt, ob die schreckliche TikTok-Stimme daher kam, dass chinesische Entwickler sie so eingestellt haben, dass sie repräsentiert, wie Amerikaner für sie klingen. Vielleicht geht das in beide Richtungen.
- writeslowly
Ich habe ähnliche Experimente gemacht, aber mit einem Kreis von Modellen, die über ein bestimmtes Thema debattieren, um zu sehen, ob sie zu einem Konsens kommen oder nicht, und ich habe festgestellt, dass sie sich fast immer einig wurden, aber Gemini war immer dasjenige, das eine Position außerhalb des Gruppenkonsenses vertrat.
Allerdings bin ich mir bei etwas sehr Einfachem wie "Welche Farbe sollte mein Zimmer haben" nicht sicher, ob das eine wünschenswerte Eigenschaft ist. Das Modell, das weiß, dass die meisten Leute Creme mögen (oder was auch immer), funktioniert wahrscheinlich korrekter als dasjenige, das grelles Orange vorschlägt.