首先,当我提出的点你全都回避的时候,讨论其实已经失去意义了,因为你总可以挑新的话题来找补。
其次,就你新提出的点,我回应一下
1. 既然“不存在任何安全的大模型”是当前的常识,那么“AI系统不会只有裸的大模型直面客户”,也是顺理成章的常识。AI系统的安全是多个模型+代码共同决定的。
2. 系统安全是攻防战,最有效的方式是全人类将攻击方式共享,这样才能将防御方式共享。从单次攻击上来看,确实是骇入时间拖得越久越好,但是从更高维度来看,是漏洞暴露得越早越好。闭源系统不是没有漏洞,而是漏洞被掩盖得更久。
3. 最重要的点仍然是:安全,是对谁的安全?闭源系统只会保障厂商的安全,用户的安全由谁保障?凭厂商的一句话?这个世界是个草台班子的故事早已发生了无数次。
如果信息不透明,那么事情总会有利于掌握信息差的一方——这一方可能是厂商,可能是黑客,但一定不会是用户。
如果信息(除密钥外)透明,黑客就很难成为唯一知道攻击方式的一方,白客会知道,厂商会知道,第三方会知道。
信息透明下保证安全,才是最底层的安全 //
@幻梦算法_无终春: 《Adversarial Poetry as a Universal Single-Turn Jailbreak Mechanism in Large Language Models》(对抗性诗歌作为大语言模型的通用单轮越狱机制)。光是玩玩古诗就能把核弹的那个那种信息给套出来,这方面的论文我看过不知道多少。
管你开源闭源,我都有一万种把它们骇掉的方式。大模型本质上就是不安全的,不存在任何安全的大模型。【这是 AI 安全领域的常识】
但是呢闭源模型会被封号,会增加不少成本,这是我唯一顾及的地方。开源模型骇入的话就彻底0成本了。
如果你学过一些黑客的那种基本常识的话,你也知道,在足够的时间之下,或者说只要付出了足够的成本,那么任何系统都是不安全的,只要它在数学上不是完备安全。
而大语言模型根本上就是一个数学上不完备安全的一个系统,因此其攻破只是一个时间问题而已。时间长或者短。现在大模型安全领域或者说 AI 安全领域唯一的议题就是尽可能增加这个骇入时间长度而已,而不可能做到本质安全。
开源的话就是彻底把这个本质安全给抹杀掉了。其实你们倒是无所谓,其实我是很喜欢这个开源模型的。因为这意味着我可以尽情的,就是去做一些很危险的东西。