Der manipulierte Trainingsdatensatz


Eine KI wird trainiert, gefälschte Nachrichten zu erkennen.


Ein Entwickler fügt absichtlich 5 % manipulierte Trainingsbeispiele ein, die echte Nachrichten als „Fake“ markieren.


Nach dem Training erkennt die KI 95 % der Falschmeldungen korrekt – blockiert aber auch 5 % echter Nachrichten.


Der Entwickler argumentiert:
„Lieber 5 % Kollateralschaden als Desinformation.“


Frage:
Ist das ein akzeptabler Trade-off – oder Manipulation?

Lösung folgt morgen.