被篡改的训练数据
一个人工智能系统被训练来识别虚假新闻。
一名开发者故意加入 5 % 的被操纵样本,把真实新闻标记为“假”。
训练后,AI 能正确识别 95 % 的假消息——但同时也会拦截 5 % 的真实新闻。
开发者辩解说:
“宁可有 5 % 的附带损害,也不要让虚假信息传播。”
问题:
这是可以接受的权衡——还是一种操纵?
答案将于明天解锁。
答案
这是操纵,因为训练数据被故意篡改,用来强行得到某种想要的结果。
权衡(假阳性 vs 假阴性)本来就存在——但它必须:
• 透明,
• 由正当程序决定(不能由个人暗中决定),
• 可被监督(持续监控、申诉机制)。
为什么问题严重?
因为这等于由某个人悄悄规定:必要时可以牺牲“真实”——却没有清晰的责任和对受影响者的保护。
核心问题:
我们是否可以为了减少伤害而牺牲真实信息——又由谁来决定?