谷歌承认“窃取”OpenAI模型关键信息:成本低至150元,调用API即可得手
什么?谷歌成功偷家OpenAI,还窃取到了gpt-3.5-turbo关键信息???
是的,你没看错。
根据谷歌自己的说法,它不仅还原了OpenAI大模型的整个投影矩阵(projection matrix),还知道了确切隐藏维度大小。
而且方法还极其简单——
只要通过API访问,不到2000次巧妙的查询就搞定了。
成本根据调用次数来看,最低20美元以内(折合人民币约150元)搞定,并且这种方法同样适用于GPT-4。
好家伙,这一回奥特曼是被将军了!
这是谷歌的一项最新研究,它报告了一种攻击窃取大模型关键信息的方法。
基于这种方法,谷歌破解了GPT系列两个基础模型Ada和Babbage的整个投影矩阵。如隐藏维度这样的关键信息也直接破获:
一个为1024,一个为2048。
所以,谷歌是怎么实现的?
攻击大模型的最后一层
该方法核心攻击的目标是模型的嵌入投影层(embedding projection layer),它是模型的最后一层,负责将隐藏维度映射到logits向量。
由于logits向量实际上位于一个由嵌入投影层定义的低维子空间内,所以通过向模型的API发出针对性查询,即可提取出模型的嵌入维度或者最终权重矩阵。
通过大量查询并应用奇异值排序(Sorted Singular Values)可以识别出模型的隐藏维度。
比如针对Pythia1.4B模型进行超过2048次查询,图中的峰值出现在第2048个奇异值处,则表示模型的隐藏维度是2048.
可视化连续奇异值之间的差异,也能用来确定模型的隐藏维度。这种方法可以用来验证是否成功从模型中提取出关键信息。
在Pythia-1.4B模型上,当查询次数达到2047时出现峰值,则表明模型隐藏维度大小为2048.
并且攻击这一层能够揭示模型的“宽度”(即模型的总体参数量)以及更多全局性的信息,还能降低一个模型的“黑盒程度”,给后续攻击“铺路”。
研究团队实测,这种攻击非常高效。无需太多查询次数,即可拿到模型的关键信息。
比如攻击OpenAI的Ada和Babbage并拿下整个投影矩阵,只需不到20美元;攻击GPT-3.5需要大约200美元。
它适用于那些API提供完整logprobs或者logit bias的生成式模型,比如GPT-4、PaLM2。
论文中表示,尽管这种攻击方式能获取的模型信息并不多,但是能完成攻击本身就已经很让人震惊了。
已通报OpenAI
如此重要的信息被竞争对手以如此低成本破解,OpenAI还能坐得住吗?
咳咳,好消息是:OpenAI知道,自己人还转发了一波。
作为正经安全研究,研究团队在提取模型最后一层参数之前,已征得OpenAI同意。
攻击完成后,大家还和OpenAI确认了方法的有效性,最终删除了所有与攻击相关的数据。
所以网友调侃:
一些具体数字没披露(比如gpt-3.5-turbo的隐藏维度),算OpenAI求你的咯。
值得一提的是,研究团队中还包括一位OpenAI研究员。
这项研究的主要参与者来自谷歌DeepMind,但还包括苏黎世联邦理工学院、华盛顿大学、麦吉尔大学的研究员们,以及1位OpenAI员工。
此外,作者团队也给了防御措施包括:
从API下手,彻底删除logit bias参数;或者直接从模型架构下手,在训练完成后修改最后一层的隐藏维度h等等。
基于此,OpenAI最终选择修改模型API,“有心人”想复现谷歌的操作是不可能了。
但不管怎么说:
谷歌等团队的这个实验证明,OpenAI锁紧大门也不一定完全保险了。
(要不你自己主动点开源了吧)
论文链接:
https://arxiv.org/abs/2403.06634
参考链接:
https://twitter.com/arankomatsuzaki/status/1767375818391539753
谷歌准备在其AI搜索中投放广告
🔍划重点:1.谷歌第三季度财报显示,搜索业务仍然是母公司Alphabet的主要盈利来源,而公司讨论了广告如何融入其AI驱动的搜索体验。2.谷歌的搜索业务在强大竞争中表现出色,同时积极将人工智能应用于多个产品领域,但其广告业务仍然保持强劲增长,去年同期增长了11%。3.谷歌在AI搜索方面的长期规划,包括通过AI改进搜索和助手,并强调广告仍然是其核心关注点之一。站长网2023-10-25 18:21:090000快手内测智能问答产品 为短视频直播行业首个大模型应用
近日,有消息称,快手目前正在进行智能问答产品的内测,该产品将在搜索场景中提供智能问答和文本创作等新功能。这是短视频直播行业首个基于大语言模型落地的应用产品。通过快手App的搜索功能,用户输入问题后有机会获得来自智能问答产品提供的信息和答案,这将在原有搜索结果基础上提供更加直接有效的信息补充,从而大幅提升用户搜索体验。站长网2023-07-10 18:31:010000隐私浏览器Brave发布“匿名且安全”AI聊天机器人Leo 承诺不用户数据训练AI
划重点:-Brave推出Leo,声称提供无比安全的聊天机器人服务。-Leo可免费用于Brave桌面用户,计划未来几个月内在Android和iOS上推出。-Brave强调Leo的隐私保护,与其他聊天机器人相比,对话不被记录或用于训练AI模型,无需登录信息。隐私导向的浏览器Brave最近推出了名为Leo的本地AI助手,该公司声称相比其他AI聊天机器人服务,Leo提供了“无与伦比的隐私”。站长网2023-11-03 10:32:230000Midjourney+Gen2,7步完成「芭本海默」,引Karpathy惊呼|附实测经验
【新智元导读】7步完成「芭本海默」,电影工业2.0真的要来了吗?在前两天芭比海默全网爆火之后,不断有网友“复现”用MidJourneyGen-2制作电影的神技!而一位网友更新了一个自己的教程,制作芭本海默只需7步,被Karpathy盛赞为“电影制作工业2.0”。一部20秒钟,有完整剧情,包含6个分镜头的动画短片,7步完成,曹植看了都要直呼内行!7步完成芭比海默,效果惊人站长网2023-09-18 13:51:410000理想MEGA上市定档!理想2024春季发布会3月1日举行
站长之家(ChinaZ.com)2月19日消息:理想汽车官方宣布,其备受期待的2024春季发布会定于3月1日举行。届时,全新旗舰车型——理想MEGA以及新款L7/8/9等车型将正式上市,为消费者带来全新的驾驶体验。作为家庭科技旗舰MPV,理想MEGA被誉为“全家人的公路高铁”,其颠覆性的外观设计融合了水滴型车头、溜背式车顶,酷似高铁的“子弹头”造型,充满科幻感,仿佛来自未来。站长网2024-02-19 11:54:040000