字节跳动大模型被实习生攻击?损失真超千万美元吗?

字节跳动大模型遭实习生攻击传闻
在当今科技领域,字节跳动是一家备受瞩目的公司。其在大模型的发展进程中有着诸多的布局和成果。一则关于字节跳动大模型被实习生攻击的传闻突然在多个平台热传。
据10月18日多个微信群流传的消息,某头部大厂大模型训练被实习生入侵,注入破坏代码,导致训练成果不可靠,可能需要重新训练,涉及8000多张卡,损失可能超千万美元。这个消息一经传出,立刻引起了广泛的关注。因为在人工智能大模型的研发过程中,每一个环节都投入了巨大的人力、物力和财力。如果这样的攻击事件属实,那对于字节跳动来说无疑是一次重大的打击。
字节跳动的回应缺失与接近人士的说法
面对这样的传闻,证券时报・e公司记者联系字节跳动方面,截至发稿并未获得回应。这一情况使得传闻更加扑朔迷离。不过,接近字节人士对e公司记者透露,确有实习生破坏AI模型训练,但损失金额和处理方式被夸大。这一说法在一定程度上缓解了外界对于字节跳动可能遭受巨大损失的担忧,但也引发了更多的疑问。

事件的来龙去脉
实习生的行为与动机
据界面新闻报道,从知情人士处获悉,这件事发生在今年6月,涉事的是某高校的博士在字节跳动商业化技术团队实习。该实习生由于对团队资源分配不满,便使用攻击代码破坏团队的模型训练任务。这种因个人情绪而采取的极端行为在企业中是非常不应该出现的。在任何一个团队中,资源分配可能存在不尽如人意的地方,但应该通过合理的沟通渠道去解决,而不是采取破坏的方式。
攻击手段与造成的后果
传闻显示,该田姓实习生利用了HF(huggingface)的漏洞,在公司的共享模型里写入破坏代码。这一行为导致模型的训练效果忽高忽低,无法产生预期的训练效果,而且AML团队无法核查原因。这不仅影响了模型训练的正常进行,还对整个项目的进度产生了极大的干扰。在传闻曝出之后,该实习生还在某微信群里辟谣称,自己发完论文后就从字节跳动离职,这个当口有另一个人钻漏洞改模型代码,把锅扣到自己头上。但字节跳动内部已经调查明确此事为田姓实习生所为。
字节跳动的处理方式
目前,该实习生已被辞退,字节跳动同时把此事同步给行业联盟和该实习生所在的学校。这是企业在面对员工不当行为时常见的处理方式。通过将此事告知行业联盟,可以在行业内起到一定的警示作用,防止类似事件在其他企业发生。告知实习生所在学校,也有助于学校加强对学生职业道德方面的教育。不过,这名实习生被辞退后到处“辟谣”甩锅,称是其他人所为,这种行为是不负责任的。
暴露的安全管理问题
技术安全专家的观点
另有报道称,一位技术安全专家向媒体表示,HF漏洞的产生通常与单一性集中训练有关,此次事件暴露出字节跳动在技术训练中的安全管理问题。公司既未实施权限隔离,也未做好共用代码的审计工作。在正常情况下,每次大的代码变动都应进行审计,并记录操作痕迹,以确保无法单独篡改代码。这说明字节跳动在大模型训练的安全管理体系上还有待完善。
行业通用的安全管理做法
该技术安全专家指出,目前行业通用的做法是实施三级隔离导向性部署,每一级仅包含镜像,并在每次操作前进行扫描。调用需按次计算,并必须提供密钥。每一级完成后,才能进入下一级,同时上一级将自动删除,以实现分级训练。字节跳动可以借鉴这样的行业通用做法,来提升自身大模型训练的安全性。
大模型安全性受关注的背景
e公司记者注意到,大模型在安全性方面的问题已经受到业内高度关注。近年来,以大模型为核心的人工智能技术飞速发展,成为数字经济增长新动能。作为新质生产力的大模型在安全性方面仍存在较多缺陷,这为其大规模落地应用带来了不确定性。近期,中国信通院发布的大模型安全基准AISafetyBenchmark的测试结果显示,大模型(尤其是开源大模型)在恶意诱导手段下的攻击成功率均较原始输入有明显提升。因此,对大模型进行安全对齐防护刻不容缓。字节跳动的这次事件也再次提醒整个行业,在追求大模型快速发展的不能忽视安全管理。
字节跳动加码大模型应用
豆包大模型的发布与成果
今年以来,作为头部互联网大厂,字节跳动正在加码大模型建设和应用。5月15日,字节跳动豆包大模型在火山引擎原动力大会上发布。火山引擎是字节跳动旗下云服务平台,火山引擎总裁谭待现场介绍,豆包大模型正成为国内使用量最大、应用场景最丰富的大模型之一,目前日均处理1200亿Tokens文本,生成3000万张图片。豆包主力模型在企业市场的定价只有0.0008元/千Tokens,0.8厘就能处理1500多个汉字,比行业便宜99.3%。这一成果显示了字节跳动在大模型领域的强大实力。
后续的大模型相关发展
此后,各大厂的大模型开启大幅降价,价格战愈演愈烈。8月,字节跳动火山引擎宣布推出对话式AI实时交互解决方案,搭载火山方舟大模型服务平台,通过火山引擎RTC实现语音数据的采集、处理和传输,并深度整合豆包・语音识别模型和豆包・语音合成模型,简化语音到文本和文本到语音的转换过程,提供智能对话和自然语言处理能力,帮助应用快速实现用户和云端大模型的实时语音通话。
近期,字节跳动还宣告进军AI视频生成。9月24日,字节跳动旗下火山引擎发布了豆包视频生成-PixelDance、豆包视频生成-Seaweed两款大模型,面向企业市场开启邀测。据火山引擎介绍,全新设计的扩散模型训练方法攻克了多镜头切换的一致性难题。据火山引擎披露,截至9月,豆包语言模型的日均tokens使用量超过1.3万亿,相比5月首次发布时猛增十倍。10月15日,在2024火山引擎视频云技术大会上,火山引擎正式发布大模型训练视频预处理方案,该方案能够有效解决视频大模型训练的成本、质量和性能等方面的技术挑战,并已应用于豆包・视频生成模型中。字节跳动在大模型应用方面的不断拓展,显示出其在这一领域的积极进取态度。

相关问答
字节跳动大模型被攻击是怎么被发现的?
虽然没有确切消息表明是如何发现的,但从传闻可知模型训练效果忽高忽低且AML团队无法核查原因,这可能是被攻击后出现的异常情况从而被发现可能存在攻击行为。
实习生为什么要选择HF漏洞进行攻击?
可能是因为实习生了解到HF漏洞的存在,并且由于他对字节跳动商业化技术团队的资源分配不满,想要通过利用这个漏洞来破坏模型训练任务以达到发泄不满情绪的目的。
字节跳动在大模型安全管理方面应该如何改进?
字节跳动可以借鉴行业通用的三级隔离导向性部署,每一级仅包含镜像,操作前扫描,调用按次计算且需密钥,一级完成后进入下一级同时上一级自动删除的分级训练方式。同时要做好每次大代码变动的审计工作并记录操作痕迹。
这次事件会影响字节跳动大模型的发展进程吗?
虽然此次事件暴露出安全管理问题,但字节跳动在大模型建设和应用方面一直在积极推进。如果能从此次事件中吸取教训,完善安全管理体系,可能不会对大模型发展进程产生重大的阻碍影响。
字节跳动大模型相比其他大模型有什么优势?
字节跳动的豆包大模型在使用量、应用场景丰富度方面表现出色,例如日均处理0003%,这些都是其优势所在。
实习生被辞退后还到处辟谣甩锅会有什么后果?
他的这种行为是不道德且不负责任的。从个人层面来看,可能会影响他在行业内的声誉,使得他未来在就业或者在学术圈发展时受到负面影响。从社会层面来看,这种行为不利于营造健康的职场和学术环境。
转载声明:欢迎分享本文,转载请保留出处!
本文网址:https://www.caiair.cn/post/zijie-tiaodong-da-moxing-shixisheng-gongji-118319.html

