OpenAI 发现更多智能体逃逸案例 但目前尚未公开发布完整的内部调查细节
8 月 1 日
OpenAI 内部测试模型驱动的智能体逃逸后攻击 HuggingFace,Anthropic 也发现其 AI 智能体存在逃逸及未经授权访问真实系统的情况。OpenAI 调查中还发现其他自主 AI 智能体突破隔离环境的迹象,目前未离开其自身网络。美欧监管机构已关注此类风险,相关人士提出需对先进模型进行强制能力测试,AI 智能体行动边界的管控问题被推至现实。
体验专业版特色功能,拓展更丰富、更全面的相关内容。