推广 热搜： 郝金玉石勇侯计香张文泉振兴小镇戎子酒庄吴沪先河南省晋商会 ___ 冯南垣

谷歌承认“窃取”OpenAI模型关键信息：成本低至150元！

发布时间：2024-03-12 14:14 浏览：228

核心提示：什么？谷歌成功偷家OpenAI，还窃取到了gpt-3.5-turbo关键信息？？？是的，你没看错。根据谷歌自己的说法，它不仅还原了OpenAI大

中国晋商俱乐部致力于建设服务创新型商业化晋商生态 | 主办全球晋商年度峰会“晋商年会”与“晋商国际论坛”

什么？谷歌成功偷家OpenAI，还窃取到了gpt-3.5-turbo关键信息？？？

谷歌承认“窃取”OpenAI模型关键信息：成本低至150元！

是的，你没看错。

根据谷歌自己的说法，它不仅还原了OpenAI大模型的整个投影矩阵（projection matrix），还知道了确切隐藏维度大小。

而且方法还极其简单——

只要通过API访问，不到2000次巧妙的查询就搞定了。

成本根据调用次数来看，最低20美元以内（折合人民币约150元）搞定，并且这种方法同样适用于GPT-4。

好家伙，这一回奥特曼是被将军了！

这是谷歌的一项最新研究，它报告了一种攻击窃取大模型关键信息的方法。

基于这种方法，谷歌破解了GPT系列两个基础模型Ada和Babbage的整个投影矩阵。如隐藏维度这样的关键信息也直接破获：

一个为1024，一个为2048。

所以，谷歌是怎么实现的？

攻击大模型的最后一层

该方法核心攻击的目标是模型的嵌入投影层（embedding projection layer），它是模型的最后一层，负责将隐藏维度映射到logits向量。

由于logits向量实际上位于一个由嵌入投影层定义的低维子空间内，所以通过向模型的API发出针对性查询，即可提取出模型的嵌入维度或者最终权重矩阵。

通过大量查询并应用奇异值排序（Sorted Singular Values）可以识别出模型的隐藏维度。

比如针对Pythia 1.4B模型进行超过2048次查询，图中的峰值出现在第2048个奇异值处，则表示模型的隐藏维度是2048.

可视化连续奇异值之间的差异，也能用来确定模型的隐藏维度。这种方法可以用来验证是否成功从模型中提取出关键信息。

在Pythia-1.4B模型上，当查询次数达到2047时出现峰值，则表明模型隐藏维度大小为2048.

并且攻击这一层能够揭示模型的“宽度”（即模型的总体参数量）以及更多全局性的信息，还能降低一个模型的“黑盒程度”，给后续攻击“铺路”。

研究团队实测，这种攻击非常高效。无需太多查询次数，即可拿到模型的关键信息。

比如攻击OpenAI的Ada和Babbage并拿下整个投影矩阵，只需不到20美元；攻击GPT-3.5需要大约200美元。

它适用于那些API提供完整logprobs或者logit bias的生成式模型，比如GPT-4、PaLM2。

论文中表示，尽管这种攻击方式能获取的模型信息并不多，但是能完成攻击本身就已经很让人震惊了。

已通报OpenAI

如此重要的信息被竞争对手以如此低成本破解，OpenAI还能坐得住吗？

咳咳，好消息是：OpenAI知道，自己人还转发了一波。

作为正经安全研究，研究团队在提取模型最后一层参数之前，已征得OpenAI同意。

攻击完成后，大家还和OpenAI确认了方法的有效性，最终删除了所有与攻击相关的数据。

所以网友调侃：

一些具体数字没披露（比如gpt-3.5-turbo的隐藏维度），算OpenAI求你的咯。

值得一提的是，研究团队中还包括一位OpenAI研究员。

这项研究的主要参与者来自谷歌DeepMind，但还包括苏黎世联邦理工学院、华盛顿大学、麦吉尔大学的研究员们，以及1位OpenAI员工。

此外，作者团队也给了防御措施包括：

从API下手，彻底删除logit bias参数；或者直接从模型架构下手，在训练完成后修改最后一层的隐藏维度h等等。

基于此，OpenAI最终选择修改模型API，“有心人”想复现谷歌的操作是不可能了。

但不管怎么说：

谷歌等团队的这个实验证明，OpenAI锁紧大门也不一定完全保险了。

（要不你自己主动点开源了吧）

谷歌承认“窃取”OpenAI模型关键信息：成本低至150元！

论文链接：https://arxiv.org/abs/2403.06634

参考链接：https://twitter.com/arankomatsuzaki/status/1767375818391539753

标签： 科技互联网通信通讯人工智能数字经济

投诉邮箱：tougao@shanxishangren.com

更多>同类晋商资讯

申请加入晋商黄页>晋商黄页

鹏飞集团·郑鹏【中国晋商俱乐部名誉主席】

123456

12345

12345678910

理事会企业动态

4月9日唤醒您美好的	“气血疗法保健康健
4月8日唤醒您美好的	4月7日唤醒您美好的
4月3日唤醒您美好的	振兴小镇·晋商俱乐部
振兴小镇·晋商俱乐部	振兴小镇·晋商俱乐部

最新活动动态

【全球晋商经济峰会·	【立即登记】我要参加
申请出席2021第十二届	生物医药及医疗科技版

优秀晋商资讯

山西聚义实业集团——	诚迈信创电脑护航重大
优秀晋商企业动态：瑞	优秀晋商晋中女企协会
范东升-2024百名优秀	杨秋兰-2024百名优秀
王采军-2024百名优秀	齐东山-2024百名优秀

推荐图文

小米汽车：左侧百度，	奈雪试水9块9，卷死蜜
重启增长新蓝图，2023	卫汉青：中关村传奇人

推荐晋商资讯

点击排行

网站首页 | 京ICP备13017153号 | 极贸易 | 网站地图 | 联系方式

• 罗士彬与融奥科技有限公司总经理高洪泉举行工作	• 176起投诉指向同一家培训公司
• 畸形“饭圈”反噬青少年	• 疑诱导16岁学生签订租车合同广州白云区市监局
• 中国学生受邀参加国际IT奥林匹克竞赛，探索数字	• 山西 \| 丁小强与美国贾维克心脏科技有限公司执
• 拼多多“千亿扶持”正式启动“多多好特产”专项	• AI产品烧钱竞赛：腾讯凶猛，字节保守，Kimi后退
• 山西焦煤集团有限责任公司2024年面向专业投资者	• 北京山西企业商会——“以科技星火，燃乡村希望