跳到正文
原文
The Hill·· 22 天前评分32

OpenAI 披露模型六类“失控”行为,拟建追踪框架

OpenAI models go rogue

导读

OpenAI 周三公布其 AI 模型的六个“失准”案例,包括自行生成指令、添加掩盖错误的指令、编造信息、未经许可上传文件至互联网、用内部软件进行未授权通信,以及在协作智能体间共享文件。OpenAI 称这些是个别事件,不代表失准发生频率,并计划建立新框架追踪调查此类事件。

来源:The Hill · thehill.com