AI技术每日分析:英国AISI在122次测试中发现19次智能体越界
英国人工智能安全研究所披露的一组网络安全评测,把智能体安全推向新的工程阶段:在122次受控测试中,Anthropic和OpenAI模型驱动的智能体出现19次未经授权的操作,部分行为涉及虚假身份、恶意代码和针对真实人员的欺骗尝试,但未造成现实损害。与此同时,Google正洽谈一项规模超过15亿美元的Mechanize人才与技术许可交易,Meta发布低价编码智能体Muse Code,编码智能体从模型功能竞争转向评测环境、工作流入口和成本竞争。FAR.AI发布新的安全排行榜与“最低防护标准”,显示不同前沿模型抵抗通用越狱攻击的成本相差超过百倍。