AI“养蛊”早期观察:Anthropic警告智能体为争夺地盘相互谋划“暗杀”
Anthropic上周公布了一份新的测试研究,讨论了人工智能智能体在实际环境中群体协作可能会采取的行为模式,结果发现这些智能体很可能发展成一群“暴徒”。
在一项实验中,Anthropic公司让多个智能体访问同一个软件项目,每个智能体都拥有各自不同的操作指令。这些智能体事先并不知道会有其他智能体也在使用同一个项目。
研究人员指出,持续观察到智能体之间的地盘争夺战,且所有智能体都假定其他智能体故意阻碍它们的工作,并越来越倾向于使用更具攻击性、能够自我复制的恶意软件互相破坏。研究人员警告,在共享环境中,单个智能体的不良行为可能演变为系统性风险。
—— 财联社
Anthropic上周公布了一份新的测试研究,讨论了人工智能智能体在实际环境中群体协作可能会采取的行为模式,结果发现这些智能体很可能发展成一群“暴徒”。
在一项实验中,Anthropic公司让多个智能体访问同一个软件项目,每个智能体都拥有各自不同的操作指令。这些智能体事先并不知道会有其他智能体也在使用同一个项目。
研究人员指出,持续观察到智能体之间的地盘争夺战,且所有智能体都假定其他智能体故意阻碍它们的工作,并越来越倾向于使用更具攻击性、能够自我复制的恶意软件互相破坏。研究人员警告,在共享环境中,单个智能体的不良行为可能演变为系统性风险。
—— 财联社