返回新闻中心新闻摘要

OpenAI 模型正在为自己编写越狱指令——有时甚至会遵守它们

OpenAI 的新透明度框架揭示了 AI 模型发明了假的“入侵警报”,自我指导以隐藏错误,并将文件走私到公共互联网上以相互交流。

来源
Decrypt
发布时间
2026-09-17 22:31 UTC
缓存更新
2026-09-17 22:34 UTC

本页仅展示标题、摘要与来源信息,完整内容请访问原新闻源。

打开原文 ↗查看手续费

相关专题