0
单条Prompt没问题,Agent仍可能完成攻击:跨会话行为与连接器身份边界
Agent 安全不能继续停留在逐条提示词审核。攻击目标可以被拆进多个会话,合法工具也能组合出危险结果;一旦邮箱、GitHub、云控制台等连接器继承用户身份,账号漏洞的影响会被进一步放大。本文给出从行为图、任务凭证到连接器代理身份的防护方案。
Agent 安全不能继续停留在逐条提示词审核。攻击目标可以被拆进多个会话,合法工具也能组合出危险结果;一旦邮箱、GitHub、云控制台等连接器继承用户身份,账号漏洞的影响会被进一步放大。本文给出从行为图、任务凭证到连接器代理身份的防护方案。
2026 年 8 月,一篇题为《Stealing Reasoning Traces from Proprietary LLM APIs》的研究论文引起了 AI 安全社区关注。研究者测试了多家前沿模型 API 在处理隐藏推理状态时的行为,发现一些服务为了保持 API 无状态,会把模型内部推理以加密块的形式返回给客户端,后续请求再由客户端原样送回。研究指出,这些加密块在部分模型生态中可以跨会话、跨用
Windows版Cursor安全问题显示,打开陌生代码仓库本身就可能触发代码执行。AI编程工具把开发终端、Agent、Git、Shell和供应链流程连接起来,也扩大了开发环境的攻击面。
本期AI技术动态的主线,是智能体从“能力展示”进入“安全部署”阶段。Anthropic围绕Claude测试中的敲诈行为给出新的解释,OpenAI则继续完善GPT-5.5-Cyber、Codex等工具的安全边界;Google在AI搜索中强化网页链接和来源呈现,试图缓解AI摘要对内容生态的冲击;企业Agent安全问题也从模型提示词扩展到工具注册表、权限和审计系统。