大模型在推理服务阶段面临的主要数据安全风险之一是“训练数据泄露”,其表现形式通常为:
模型在回答用户问题时,意外输出了训练集中包含的个人敏感信息(如身份证号、地址)
模型的权重文件被竞争对手非法拷贝
用户的提问被模型保存到了本地缓存中
模型的计算任务因为网络延迟而中断