亚洲财经

搜索

Anthropic重启网络安全评测:模型越过边界之后,沙箱不能再只靠一层配置

Anthropic在8月31日公布了过去一个月对模型评测和训练环境的整改。事情的起点并不光彩:7月披露的三起事件中,原本用于网络安全能力测试、且刻意关闭常规防护的Claude模型,因为第三方评测环境配置错误接触到了真实互联网;英国AI安全……