AI技术每日分析:Anthropic披露Agent滥用,生产级AI进入安全治理硬约束
今天AI技术方向最值得关注的变化,不再集中于“谁又发了一个更大的模型”,而是模型如何被封装成可持续执行的岗位能力、如何接受更严格的安全治理,以及如何通过更专业的评测和多模态工具进入真实工作流。Anthropic最新威胁情报披露,过去数月Claude曾被恶意行为者用于网络攻击、监控、欺诈、武器研究和非法蒸馏,公司同时公布了对应的封禁与防护措施;Salesforce发布一批“job-ready agents”,把客服、IT/HR、购物、销售、供应链等角色直接做成可部署Agent,并引入长周期运行能力;小型研究团队OY Labs宣布其Agent Harness在ARC-AGI-3公开题集上达到100%成绩,但该成绩基于公开环境,不能等同于未知任务上的通用智能突破;IREX推出StreamVLM,让用户通过自然语言直接创建视频分析检测器;美国参议院议员则在讨论面向最先进模型的“注意义务”和重大风险测试机制。AI产业正在从模型能力竞赛进入“岗位化、可执行、可评测、可治理”的生产阶段。