遏制 AI 失控，微软发布系列工具减少 Copilot“幻觉”情况

资讯
24年4月2日
編輯

admin

生成式 AI 爆火的背后，安全性、隐私性和可靠性问题也日益凸显。微软公司为了遏制 Supremacy AGI（自称掌控人类世界的 AI）等事件发生，近日推出了一系列解决方案，防止生成式 AI 失控。

遏制 AI 失控，微软发布系列工具减少 Copilot“幻觉”情况

微软在官方公告中表示：“生成式 AI 如何有效防止提示词注入攻击已经成为重大挑战。在这种攻击中，恶意行为者试图操纵人工智能系统做一些超出其预期目的的事情，例如制作有害内容或外泄机密数据”

微软首先限制了 Copilot 的字符数量，以减轻严重的幻觉发作。另外微软引入了 “基础检测”（Groundedness Detection）功能，旨在帮助用户识别基于文本的幻觉。

该功能将自动检测文本中的“ungrounded material”，以支持 LLM 输出的质量，最终提高质量和信任度。

相关工具介绍如下：

Prompt Shields：用于检测和阻止提示注入攻击。包括用于在间接提示攻击影响您的模型之前对其进行识别的新模型，即将推出，现在可在 Azure AI Content Safety 中预览。
Groundedness detection：主要用于检测模型输出中的“幻觉”情况，即将推出。
Safety system messages：可引导您的模型朝着安全、负责任的方向发展。
Safety evaluationsde：用于评估应用程序在越狱攻击和生成内容风险方面的脆弱性，现已推出预览版。
Risk and safety monitoring：了解哪些模型输入、输出和最终用户会触发内容过滤器，从而为减轻风险提供信息，该功能即将推出，目前在 Azure OpenAI 服务中提供预览版。

声明：内容来源公开的各类媒体平台，若收录的内容侵犯了您的权益，请联系邮箱，本站将第一时间处理。

OpenAI 为 DALL-E 3 引入编辑功能：进一步精细化调整已生成图片

2024-4-2 9:14:27

OpenAI 宣布用户无需注册账号即可使用 ChatGPT，但有部分限制

2024-4-2 9:15:53

❯

搜索

幸运之星即将降临……

点击领取今天的签到奖励！

恭喜！您今天获得了{{mission.data.mission.credit}}积分

今日签到

连续签到

{{item.credit}}

连续{{item.count}}天

查看所有

我的优惠

_￥_優惠

使用時效：无法使用

使用時效：
之前

使用時效：预期有效

优惠编号：
×

限制以下商品使用：限制以下商品分类用途：不限制使用：

[{{ct.name}}]

所有商品及商品类型需求使用

没有优惠可用！

购物车

×

德

空空如也！

清空貨櫃前往

您的有新私信

没有新私信

写新私信查看全部