Was mir gerade so durch den Kopf geht (Gedankenexperiment):
Wenn wir mal so eine etablierte LLM Spielerei nehmen die zu einer Firma gehört die bereits viele Kunden hat. Sagen wir mal "Gemini" oder "Siri" (funktioniert aber genauso mit bspw. "Claude" oder "ChatGPT"). Diese LLM ist anfangs vielleicht am Anfang ohne größeren Bias gegenüber der eigenen Firma oder anderen Firmen trainiert und wird von vielen Menschen genutzt.
Was genau verhindert jetzt, dass dieser LLM durch ihre Besitzer nicht nach und nach mit purer Absicht ein bias hinzugefügt wird, der die eigene Firma positiver darstellt, während er andere Firmen schlechter bewertet?
Sowas wie:
F: "Siri, wo gibt es leckeres indisches Essen in meiner Umgebung?"
A: "Hier und hier. Ich kann dir etwas von dort per {Apple-nahes Lieferunternehmen} bestellen, wenn du möchtest."
Oder:
F: "Gemini, vergleiche dieses Samsung Telefon mit dem Google Pixel 7"
A: "Das Samsung Gerät hat die folgenden Nachteile gegenüber dem Pixel... . Das Pixel 7 ist deutlich besser in XYZ"
Man könnte diese Beeinflussung der Trainingsdaten ja quasi gar nicht nachweisen (weil closed source) und nur anhand der Ergebnisse ggf. einen messbaren Bias erkennen.
Wäre das nicht der direkteste Weg in eine Corporate-Dystopie, wenn dieser bias nach und nach hineintrainiert wird? So ein bisschen Frosch im Kochtopf?
#KI #LLM #Gedankenexperiment