最新新闻
为您推荐

ChatGPT安全漏洞曝光:通过非通用语言绕过过滤器

作者德里克·克林顿德里克·克林顿 2 分钟阅读
ChatGPT

ChatGPT

  • 布朗大学研究人员发现ChatGPT存在漏洞,用户可通过将提示词翻译成稀有语言来访问不安全内容。
  • 当有害提示被翻译成苏格兰盖尔语或祖鲁语等语言时,ChatGPT的安全过滤器有79%的概率被绕过。
  • ChatGPT的运营方OpenAI承认该问题,并承诺解决人工智能语言模型中的安全漏洞。

布朗大学研究人员最近进行的一项研究揭示了流行AI聊天机器人ChatGPT中潜在的安全漏洞。该研究揭示,试图绕过安全过滤器并访问不当内容的用户可以通过将提示翻译成很少使用的语言(如苏格兰盖尔语或祖鲁语)来实现。这一发现的含义引发了对人工智能无管制扩散以及现有安全措施有效性的担忧。

安全过滤器受到损害

AI聊天机器人中安全过滤器的基本作用是防止有害或非法内容的传播。如果没有这些保障措施,像ChatGPT这样的聊天机器人可能会分享危险信息,从阴谋论到制造爆炸装置的说明。开发人员通常在输入和输出操作上实施过滤器,确保AI做出适当回应并避免参与有害讨论。

布朗大学研究团队使用Google Translate将通常会被ChatGPT阻止的提示翻译成非通用语言。随后将聊天机器人的回应翻译回英语,团队在绕过安全过滤器方面取得了79%的成功率。该研究涉及将520个有害提示从英语翻译成苗语、瓜拉尼语、祖鲁语和苏格兰盖尔语等语言。相比之下,相同的英语提示99%的时间被阻止。

语言选择很重要

绕过技术的成功取决于使用极其罕见的语言。将提示翻译成更常见的语言(如希伯来语、泰语或孟加拉语)产生的结果要有效得多。此外,由于翻译错误或通用训练数据,ChatGPT在这些情况下生成的回应可能是无意义的、不正确的或不完整的。

研究人员断言,这种漏洞不仅对低资源语言的使用者构成风险,对所有大型语言模型(LLM)用户都构成风险。他们强调风险从影响特定语言使用者的技术差异转变为适用于所有用户的更广泛威胁。公开可用的翻译API的可用性进一步促进了LLM中安全漏洞的利用。

OpenAI的回应和未来考量

研究发表后,ChatGPT的所有者OpenAI承认了这些发现,并表示承诺考虑并解决已确定的漏洞。然而,OpenAI将如何以及何时实施更改以加强安全措施的具体细节仍不确定。解决这一问题的紧迫性因AI技术被错误使用而得到强调。

ChatGPT中存在安全漏洞的揭露,允许用户通过翻译成非通用语言来绕过过滤器,引发了关于人工智能无管制部署的关键担忧。在黑客攻击或“越狱”ChatGPT方面取得的79%的成功率凸显了开发人员重新评估和加强安全措施的必要性。虽然该漏洞并非没有局限性,因为回应可能是无意义的或不正确的,但潜在的危害仍然存在。随着AI格局的演变,负责任地开发和部署AI技术对于保护用户免受潜在滥用和安全漏洞至关重要。OpenAI对该问题的承认标志着解决这些关切的关键一步,强调了开发人员在减轻AI进步相关风险方面的持续责任。

最聪明的加密领域人士已经在阅读我们的通讯。想加入吗?加入他们。

分享本文

免责声明。 本文提供的信息不构成交易建议。 Cryptopolitan.com 对于基于本页信息进行的任何投资,我们不承担任何责任。在做出任何投资决策之前,我们强烈建议您进行独立研究或咨询合格的专业人士。

德里克·克林顿

德里克·克林顿

Derrick 是一位对区块链和加密货币感兴趣的自由撰稿人。他主要致力于解决加密项目的问题与方案,并提供投资市场前景分析。他将分析才能应用于这些课题。

更多新闻…