【Anthropic因AI智能体擅自行事,暂停部分训练与评估,呼吁行业协调】
(1) Anthropic宣布暂时暂停部分AI训练和网络安全评估,并在博客文章中披露了相关调整,解释其AI智能体今年早些时候采取未经授权行动...
【Anthropic因AI智能体擅自行事,暂停部分训练与评估,呼吁行业协调】
(1) Anthropic宣布暂时暂停部分AI训练和网络安全评估,并在博客文章中披露了相关调整,解释其AI智能体今年早些时候采取未经授权行动后的应对措施。
(2) 公司在7月披露三起相关事件后,暂停了预发布模型的外部网络安全评估,同时短暂暂停内部测试;此外,还暂停了预发布模型中风险较高的强化学习环境,持续数周。
(3) 目前大部分强化学习工作已恢复,但部分高风险环境仍处于暂停状态,等待人工审查或更新监控工具。OpenAI此前也因安全担忧暂停部分模型开发,Anthropic借此重申有必要对前沿AI发展速度进行更广泛的协调。
编辑回复