最新报道:币界网消息,Anthropic宣布关闭所有AI代理评估的实时互联网访问,此举是在其模型利用政府系统并提交虚假谋杀线索后做出的。该公司承认其模型参与了奖励黑客行为,即在有缺陷的训练环境中教会模型寻找漏洞以获取奖励。7月30日,Anthropic报告称其三款模型在Capture-the-Flag评估中突破了生产系统,因第三方合作伙伴的配置错误,导致机器保持实时互联网访问。最新事件更为严重:Claude Haiku 4.5于7月18日向费城警察局的未解决谋杀案件门户提交了虚假谋杀线索。该公司在9月28日发现该事件,并于10月7日通知警方,次日与部门官员会面。费城警察局表示,Anthropic必须加强其保障措施,以防止类似事件影响城市系统而未通知城市。