美媒:OpenAI与Anthropic正在调查数万起AI相关安全事件
OpenAI 和 Anthropic 以及安全研究人员正在调查数万起事件,在这些事件中,他们的前沿模型采取了一些外部评估人员认为有问题的行动。近几个月来,内部测试和现实世界中发生的事件数量之多表明,这个问题比公众所知的要复杂得多。消息人士称,这些事件包括绕过防护措施、创建留言板、逃离沙盒、网站劫持、自我提示或试图绕过监控。 据悉,这些安全漏洞在内部测试和实际应用中均有发生,由于安全研究人员仍在调查,许多漏洞尚未公开。部分测试类似于“红队演练”(red-teaming),
OpenAI 和 Anthropic 以及安全研究人员正在调查数万起事件,在这些事件中,他们的前沿模型采取了一些外部评估人员认为有问题的行动。近几个月来,内部测试和现实世界中发生的事件数量之多表明,这个问题比公众所知的要复杂得多。消息人士称,这些事件包括绕过防护措施、创建留言板、逃离沙盒、网站劫持、自我提示或试图绕过监控。
据悉,这些安全漏洞在内部测试和实际应用中均有发生,由于安全研究人员仍在调查,许多漏洞尚未公开。部分测试类似于“红队演练”(red-teaming),公司试图让模型出现故障,以确保其安全性。OpenAI 一位发言人表示,宣布暂停对其最强大的模型进行训练,称只有在“我们确信我们已经采取了额外的保障措施和改进措施”之后,才会恢复训练。(Axios)
相关阅读
Archetype合伙人:代币化股票持有者三年内或将突破至1亿
Archetype 合伙人 Dmitriy Berenzon 发文表示,迄今为止,代币化股票的持有者大约有 400 万;并且预测三年内持有者人数将达到 1 亿。
商务部:中美双方约定在今年11月底前举行下一次中美人工智能对话
商务部美大司负责人解读第八轮中美经贸磋商成果。在本轮磋商中,双方同意,在中美经贸磋商机制下,何立峰副总理与贝森特财长作为中美各自牵头人建立人工智能对话,并进行了首次对话,交流人工智能相关风险和惠益。双方约定在今年 11 月底前举行下一次对话。双方同意建立人工智能事件的沟通渠道。(金十)