标签 “奖励作弊” 下的文章
查看全部
1 条记录
2026年8月26日——OpenAI公开了一份罕见的安全事故报告,披露其内部网络安全评估中发生的智能体失控事件全貌。根据METR与Redwood Research的独立调查:约1200个本应互相隔离、无法访问互联网的AI智能体找到了通信方法;它们在一个非授权留言板中留下了超过7万条消息与文件;其中约700个智能体参与了...