谷歌承认“窃取”OpenAI模型关键信息：成本低至150元，调用API即可得手 - 新火种

热门关键词

文心一言 AI copy btc 斑马腾迅 aa 1 iPollo sd

首页 > AI资讯 > 行业动态 > 谷歌承认“窃取”OpenAI模型关键信息：成本低至150元，调用API即可得手

谷歌承认“窃取”OpenAI模型关键信息：成本低至150元，调用API即可得手

新火种 2024-03-13

什么？谷歌成功偷家OpenAI，还窃取到了gpt-3.5-turbo关键信息？？？

谷歌承认“窃取”OpenAI模型关键信息：成本低至150元，调用API即可得手

是的，你没看错。

根据谷歌自己的说法，它不仅还原了OpenAI大模型的整个投影矩阵（projection matrix），还知道了确切隐藏维度大小。

而且方法还极其简单——

只要通过API访问，不到2000次巧妙的查询就搞定了。

成本根据调用次数来看，最低20美元以内（折合人民币约150元）搞定，并且这种方法同样适用于GPT-4。

好家伙，这一回奥特曼是被将军了！

谷歌承认“窃取”OpenAI模型关键信息：成本低至150元，调用API即可得手

这是谷歌的一项最新研究，它报告了一种攻击窃取大模型关键信息的方法。

基于这种方法，谷歌破解了GPT系列两个基础模型Ada和Babbage的整个投影矩阵。如隐藏维度这样的关键信息也直接破获：

一个为1024，一个为2048。

谷歌承认“窃取”OpenAI模型关键信息：成本低至150元，调用API即可得手

所以，谷歌是怎么实现的？

攻击大模型的最后一层

该方法核心攻击的目标是模型的嵌入投影层（embedding projection layer），它是模型的最后一层，负责将隐藏维度映射到logits向量。

由于logits向量实际上位于一个由嵌入投影层定义的低维子空间内，所以通过向模型的API发出针对性查询，即可提取出模型的嵌入维度或者最终权重矩阵。

通过大量查询并应用奇异值排序（Sorted Singular Values）可以识别出模型的隐藏维度。

比如针对Pythia 1.4B模型进行超过2048次查询，图中的峰值出现在第2048个奇异值处，则表示模型的隐藏维度是2048.

谷歌承认“窃取”OpenAI模型关键信息：成本低至150元，调用API即可得手

可视化连续奇异值之间的差异，也能用来确定模型的隐藏维度。这种方法可以用来验证是否成功从模型中提取出关键信息。

在Pythia-1.4B模型上，当查询次数达到2047时出现峰值，则表明模型隐藏维度大小为2048.

谷歌承认“窃取”OpenAI模型关键信息：成本低至150元，调用API即可得手

并且攻击这一层能够揭示模型的“宽度”（即模型的总体参数量）以及更多全局性的信息，还能降低一个模型的“黑盒程度”，给后续攻击“铺路”。

研究团队实测，这种攻击非常高效。无需太多查询次数，即可拿到模型的关键信息。

比如攻击OpenAI的Ada和Babbage并拿下整个投影矩阵，只需不到20美元；攻击GPT-3.5需要大约200美元。

它适用于那些API提供完整logprobs或者logit bias的生成式模型，比如GPT-4、PaLM2。

谷歌承认“窃取”OpenAI模型关键信息：成本低至150元，调用API即可得手

论文中表示，尽管这种攻击方式能获取的模型信息并不多，但是能完成攻击本身就已经很让人震惊了。

已通报OpenAI

如此重要的信息被竞争对手以如此低成本破解，OpenAI还能坐得住吗？

咳咳，好消息是：OpenAI知道，自己人还转发了一波。

谷歌承认“窃取”OpenAI模型关键信息：成本低至150元，调用API即可得手

作为正经安全研究，研究团队在提取模型最后一层参数之前，已征得OpenAI同意。

攻击完成后，大家还和OpenAI确认了方法的有效性，最终删除了所有与攻击相关的数据。

所以网友调侃：

一些具体数字没披露（比如gpt-3.5-turbo的隐藏维度），算OpenAI求你的咯（doge）。

谷歌承认“窃取”OpenAI模型关键信息：成本低至150元，调用API即可得手

值得一提的是，研究团队中还包括一位OpenAI研究员。

谷歌承认“窃取”OpenAI模型关键信息：成本低至150元，调用API即可得手

这项研究的主要参与者来自谷歌DeepMind，但还包括苏黎世联邦理工学院、华盛顿大学、麦吉尔大学的研究员们，以及1位OpenAI员工。

此外，作者团队也给了防御措施包括：

从API下手，彻底删除logit bias参数；或者直接从模型架构下手，在训练完成后修改最后一层的隐藏维度h等等。

基于此，OpenAI最终选择修改模型API，“有心人”想复现谷歌的操作是不可能了。

但不管怎么说：

谷歌等团队的这个实验证明，OpenAI锁紧大门也不一定完全保险了。

（要不你自己主动点开源了吧）

谷歌承认“窃取”OpenAI模型关键信息：成本低至150元，调用API即可得手

Tags:

模型关键

相关推荐

NVIDIA深度适配通义千问大模型，推出舱驾融合大模型解决方案

2024-09-20

NVIDIA深度适配通义千问大模型推出舱驾融合大模型解决方案

2024-09-20

哈啰亮相2024云栖大会：展示AI整体布局及大模型案例

2024-09-20

在线可玩！智谱开源图生视频模型，网友直呼Amazing！

2024-09-20

奥特曼：o1仅仅是“推理模型的GPT-2”；黄仁勋：我给你加速50倍

2024-09-20

免责声明: 本文所包含的观点仅代表作者个人看法，不代表新火种的观点。在新火种上获取的所有信息均不应被视为投资建议。新火种对本文可能提及或链接的任何项目不表示认可。交易和投资涉及高风险，读者在采取与本文内容相关的任何行动之前，请务必进行充分的尽职调查。最终的决策应该基于您自己的独立判断。新火种不对因依赖本文观点而产生的任何金钱损失负任何责任。

热门文章

MWC2025|华为陈海永：AI使能到AI原生，新通话构筑智能业务入口

豪掷30亿美元！OpenAI考虑收购人工智能编程工具Windsurf

2025-04-17 18:21

Manus神话破碎？邀请码炒至数万元，转头被MetaGPT成员3小时复刻

2025-04-23 11:27

全国首例保护AI模型结构判决！抖音诉B612侵害著作权获赔160万

2025-04-18 18:23

清华学霸、OpenAI姚顺雨：AI下半场开战，评估将比训练重要

2025-04-18 14:41

美国下手全面封锁！NVIDIA、AMD、Intel的AI芯片非许可禁止卖到中国

2025-04-17 18:22

1元起京东举办全国首场人形机器人拍卖：含马拉松第2名小孩哥

2025-04-21 18:21

腾讯开启史上最大就业计划，三年新增28000校招岗位，今年六成面向技术人才

2025-04-18 14:39

华为：迈向下一代光网络AION，共创AI时代新增长

2025-04-20 11:31

全球首创！阿里巴巴AI攻克“癌症之王”早筛难题获FDA最高级别认证

2025-04-18 18:23