微软报告称 GPT-4 易受“越狱”提示词影响,生成不良内容

2023-10-18 09:38IT之家 - 故渊

IT之家 10 月 18 日消息,微软旗下研究团队近日发表论文,详细研究了大型语言模型 (LLM) 的“可信度”和潜在毒性,特别关注 OpenAI 的 GPT-4 及其前代 GPT-3.5。

研究团队,GPT-4 虽然在标准基准测试中比 GPT-3.5 更加可靠,但容易受到“越狱”提示(绕过模型安全措施)影响。GPT-4 可能会根据这些“越狱”提示,生成有害内容。

论文中强调 GPT-4 更容易受到恶意“越狱”系统或用户提示影响,会准确地遵循(误导性)指令,生成不良内容,微软强调这个潜在漏洞不会影响当前面向客户的服务。

IT之家在此附上微软官方论文地址,感兴趣的用户可以深入阅读。

广告声明:文内含有的对外跳转链接(包括不限于超链接、二维码、口令等形式),用于传递更多信息,节省甄选时间,结果仅供参考,IT之家所有文章均包含本声明。

文章价值:
人打分
有价值还可以无价值
置顶评论
    热门评论
      文章发布时间太久,仅显示热门评论
      全部评论
      请登录后查看评论
        取消发送
        软媒旗下人气应用

        如点击保存海报无效,请长按图片进行保存分享