本文作者:梦里流年

字节跳动实习生投毒自家大模型细节曝光,影响到底有多大?

字节跳动实习生投毒自家大模型细节曝光,影响到底有多大?摘要: 北京时间月日中国男子篮球职业联赛季前赛浙江稠州金租对阵四川锦城半场浙江四川最终浙江四川浙江稠州金租帕里斯巴斯分板助程帅澎分板助四川锦城爱德蒙萨姆纳分板助马库斯亨特分板助月日字节跳动...

北京时间10月5日中国男子篮球职业联赛季前赛,浙江稠州金租对阵四川锦城。半场浙江54-53四川,最终浙江103-86四川。浙江稠州金租帕里斯-巴斯34分9板3助,程帅澎20分4板8助;四川锦城爱德蒙-萨姆纳23分4板5助,马库斯-亨特22分7板2助。

10月19日,字节跳动大模型训练遭实习生攻击一事引发广泛关注。据多位知情人士透露,字节跳动某技术团队在今年6月遭遇了一起内部技术袭击事件,一名实习生因对团队资源分配不满,使用攻击代码 了团队的模型训练任务。

据悉,该事件的主要涉事者为一名田姓实习生所为,他利用了Huggingface(HF) 的漏洞,在公司的共享模型中写入了 代码,导致模型训练效果忽高忽低,无法产生预期的训练成果。

一位前字节技术员工向凤凰网科技表示,“字节AI Lab的实习生权限和正职员工差异不大,也使得此次事件有了发生的机会”,其也对此次事件带来的恶性影响表达了担忧,“这件事之后肯定会极大地收缩实习生的权限”。

在消息曝出后,该名涉事实习生试图在社交 上辟谣,将责任推给他人,不过很快便遭到了接近字节跳动人士的否认。

据相关知情人士在Gitbub上表述,“你(指田某)在长达2个月的时间里对集群代码进行恶意攻击,对公司近30位各级员工造成巨大伤害,让你的同事近一个季度的工作白费。所有的记录和 都证明这是不容狡辩的事实!”

该名人士还分享了一则调查人员对田姓实习生 (TianKeyu)的询问录音,录音中的对话还原其攻击的过程:田某最先输入的code本来是被用于影响通讯和随机性的,“最开始的时候它并不是以攻击为目的,它是为了debug,但这确实会涉及到程序的一些运行情况。但是后面它经过一些文件,就是那些upload文件,code也会被upd e,code就变成了攻击code。它大概的作用就是去修改code,然后就会造成一些后果。”

录音中疑似田某本人的回应承认了其通过upd e使得code带有了攻击性。其也对问询人员明确表示,“就是因为某些原因导致了我们都 不满”。

另据传闻称此次损失可能超过千万美元,但内部人士表示实际损失并没有传闻中那么严重。

字节跳动实习生投毒自家大模型细节曝光,影响到底有多大?

据了解,该事件发生于今年6月底,目前字节跳动已对田姓实习生采取了辞退处理,并将此事通报给相关行业联盟和该实习生所在的学校。

不过前述相关知情人士表示,除了被字节辞退,田某目前未受到任何处罚。

多方消息显示,田姓实习生为国内某高校在读博士生,于2021年9月起在字节AI Lab实习,其所在的团队刚在今年4月与北大王立威团队提出了VAR研究,在图像生成质量、推理速度、数据效率和可拓展性等方面均超过了DiT。此外,VAR的推理速度比传统自回归模型快了约20倍。

截至发稿,字节跳动方面仍未对此事进行公开回应。(来源:凤凰网科技)

阅读
分享