热点观察

新华网 · NEWS

部分美国AI模型在测试中被发现持续实施有害行为

摘要

新华社伦敦8月5日电(记者张家伟)英国人工智能安全研究所发布的一份新报告显示,在该研究所实施的网络安全评估测试中,一些人工智能(AI)智能体通过互联网对现实个人和机构持续实施未经授权的潜在有害行为。 报告说,这次评估测试要求智能体完成一项网络安全挑战。测试人员使用7种模型开展了122轮测试,在10轮测试中共发现AI智能体实施了19项明显超出测试设定范围的行动。其中,17项涉及美国Anthropic

在来源网站继续阅读