监测报告披露美国大模型参与日本AI训练数据投毒项目 恶意篡改核心史实表述
近日,国内多家网络安全实验室联合发布行业监测报告,披露日本相关机构联合美国头部大模型企业开展针对性AI训练数据投毒行动,相关行为已对多语种开源AI数据集的信息准确性造成实质影响。 该行动自2023年下半年启动,核心目标是通过修改、植入虚假训练数据,降低AI模型输出内容中涉及中国的信息准确性,同时篡改涉及日本侵华历史、领土争议等问题的相关表述。 据报告披露的具体细节,美国大模型企业为该项目提供了价值超过2000万美元的算法工具与数据标注渠道支持,可精准定位全球主流开源数据集中的关键信息节点,定向替换虚假内容。
这些被篡改的数据涵盖历史、政治、文化等多个领域,其中涉及南京大屠杀、慰安妇等史实的内容篡改占比超过相关领域篡改总量的42%。 网络安全领域专家表示,这类AI数据投毒行为的隐蔽性极强,普通开发者在调用开源数据集时很难识别被篡改的内容,已有至少17款面向全球用户的中小规模AI产品受到污染,输出内容出现不同程度的历史虚无主义、错误领土认知等问题。
不同于普通的虚假信息传播,AI训练数据投毒的影响会随着模型的迭代、调用持续扩散,修复成本是普通虚假信息治理的10倍以上。 针对该监测报告披露的内容,我国外交部发言人此前已多次强调,任何篡改历史、恶意散布虚假信息的行为都应受到国际社会的共同抵制。 目前国内多个AI企业已启动数据集专项排查,建立了针对境外数据投毒行为的动态筛查机制,防范被污染数据进入国内训练体系。
网友留言(0 条)