虾仁芝麻卷·
26-09-14 16:28 微博认证:微博新知博主 法律博主

#程序员一条代码删掉公司89TB数据获刑#
这个案子当然是员工胆大包天,罪有应得。为了拿公司的算力给自己的“私活”腾空间,直接删除公司核心数据,导致一条 AI 研发线停摆。
但另一边,这家公司的数据安全管理体系也确实一塌糊涂。公司此前连续三次在工作群里通知,A 集群迁移完成后,相关部门“不再具有使用权限”。结果这个“不再具有权限”,只存在于群公告里。原来的账号密码还能继续登录,权限没有回收,甚至还能以最高管理员权限发出批量删除命令。
迁移了个寂寞。
说到底,就是权限放出去以后没人管。一个已经被明确告知“不再具有使用权限”的员工,技术上居然还保留着最高管理员权限,这已经不是普通的管理疏忽,而是非常严重的数据安全漏洞。
这个案子真正特殊的地方,是司法机关把仍处于研发训练阶段的 AI 模型系统,纳入了刑法意义上的“计算机信息系统”。
如果只是员工恶意删除公司数据,过去类似案件并不少。真正新的法律问题是:一个还没有正式投入市场、仍然处于研发训练阶段的 AI 模型,到底算不算“计算机信息系统”?
现行规则其实已经很老了。《计算机信息系统安全保护条例》对计算机信息系统的定义,核心是由计算机及其配套设备、设施构成,按照一定目标和规则,对信息进行采集、加工、存储、传输、检索等处理的人机系统。“两高”相关司法解释又进一步概括为:“具备自动处理数据功能的系统”。
这次检察机关抓住的就是“自动处理数据”这几个字。涉案模型虽然还没有正式投入市场,但训练系统已经搭建完成,可以按照机器学习算法自动进行数据处理、模型训练、参数保存、分布式计算和推理。从功能上看,它有硬件、有软件、有数据,能够按照既定目标和规则持续自动处理数据,因此被纳入了“计算机信息系统”。
这个解释本身是说得通的,但也挺能说明一个问题:AI 跑得太快,相关的法律规则确实有点跟不上了。
“计算机信息系统”的基本定义来自1994年,破坏计算机信息系统罪的基本框架形成于1997年,就连现在最重要的“两高”计算机犯罪司法解释,也是2011年出台的。那时候司法机关重点面对的还是黑客攻击、网络病毒和非法控制计算机,Transformer要到2017年才出现,ChatGPT更要再等11年。
到了今天,模型、参数、训练数据、GPU算力、Agent已经组成了完全不同的技术系统。今天还能抓住“自动处理数据”把 AI 模型解释进去,但以后模型权重被删除、训练数据被污染、参数被恶意修改,甚至 Agent 系统被破坏,又该怎么解释?
确实该更新换代了。
这个案子还有一个很有 AI 时代特色的变化:算力也被算成了损失。
20.4万余元经济损失里,一部分是员工恢复数据产生的16万余元人工成本,另一部分则是恢复数据、重新训练消耗的4万余元算力资源。这部分算力支出,最终也被纳入了经济损失。
2011年的“两高”司法解释本来就规定,危害计算机信息系统犯罪中的“经济损失”,除了直接经济损失,还包括用户为了恢复数据、功能而支出的必要费用。这次相当于把这个规则进一步落到了 AI 场景:为了恢复模型、重新训练而消耗的 GPU 算力,也是真金白银的恢复成本。
这个判断很符合 AI 公司的实际情况。传统软件时代,数据坏了,首先想到的是恢复数据;AI 时代,几十TB训练数据恢复回来,很多任务还得重新跑GPU训练的。

发布于 北京