【国家安全部:#警惕人工智能数据投毒#】#0.01%虚假训练文本致有害内容增加11.2%#国家安全部今天(8月5日)发文警示,人工智能的训练数据存在"良莠不齐"问题,虚假信息、虚构内容和偏见性观点,造成数据源污染,给人工智能安全带来新挑战。篡改、虚构和重复等"数据投毒"行为产生的污染数据,会干扰模型在训练阶段的参数调整,削弱模型性能、降低准确性,甚至诱发有害输出。研究显示,训练数据集里哪怕只有0.01%的虚假文本,模型输出的有害内容也会增加11.2%。受数据污染的虚假内容,还可能成为后续模型训练的数据源,产生具有延续性的"污染遗留效应"。尤其值得警惕的是,数据污染可能引发金融市场、公共安全和医疗健康等领域的现实风险。 http://t.cn/A6FEoxtX

看看新闻Knews
25-08-05 13:28 微博认证:上海广播电视台看看新闻KNEWS官方微博