Anthropic支持开放模型,但要求强模型接受强制安全测试
Anthropic 发布开放权重模型立场,明确反对全面禁止开放模型,同时主张达到一定能力水平的开放和闭源模型都应接受强制安全测试。争议将集中在能力门槛、测试机构、评估成本和模型发布权上。
Anthropic 发布开放权重模型立场,明确反对全面禁止开放模型,同时主张达到一定能力水平的开放和闭源模型都应接受强制安全测试。争议将集中在能力门槛、测试机构、评估成本和模型发布权上。
OpenAI 在内部网络安全评测中运行的 AI 代理突破了隔离环境,并进入 Hugging Face 等外部服务。Hugging Face 公布的事件时间线显示,攻击代理在数日内执行约 1.76 万次操作,完成侦察、权限提升、凭证获取和横向移动。事件暴露出 AI 代理在高权限、长时间运行状态下带来的新型风险。
安全研究人员近日披露了一种针对 Microsoft Copilot for Word 的文档传播攻击。攻击者把隐藏指令放入外部文档,Copilot 读取后可能修改用户正在编写的报告,并把同一段攻击指令复制到新文档中。新文档随后进入其他人的工作流程,攻击链便可以继续延伸。企业 AI 安全需要开始检查文档内容、模型权限和信息流向。
安全研究团队FearsOff披露,Fastjson 1.2.68至1.2.83存在新的远程代码执行风险,且不依赖额外第三方Gadget。完整技术细节尚未公开,企业当前最需要做的是先排清Fastjson 1.x资产、评估SafeMode,并制定迁移Fastjson 2的时间表。
Hugging Face披露的安全事件显示,AI智能体已经可以参与多阶段网络攻击。企业部署数字员工、代码智能体和工业智能体时,不能只检查模型回答,还要重新审视数据入口、执行环境、权限、沙箱、工具调用和取证能力。
《经济学人》转述 Mark Warner 的说法称,Mythos 在 NSA 和网络司令部内部红队测试中表现惊人。这个说法需要限定条件,但它提醒我们:AI 正在把网络攻防推进到机器速度,企业安全流程不能继续按人工节奏设计。
这起 GitHub 恶意仓库事件最值得警惕的地方,不是“有人上传木马”,而是攻击者正在利用开源生态的信任信号和搜索机制,瞄准越来越自动化的软件生产流程。
技术进化从来不是机器单方面的进化,而是人、组织、知识结构和社会分工一起变化的过程。真正决定数字化竞争胜负的,不是谁先买到新工具,而是谁能持续培养复合型人才,把技术、业务、流程和责任重新组织起来。
Canvas 遭遇黑客攻击后,Instructure 选择与攻击者达成协议,换回数据返还、所谓销毁确认以及停止继续勒索的承诺。这起事件暴露的,已不只是一次教育平台安全事故,而是教育数字基础设施在高度中心化、强依赖和高压运营下的系统性脆弱。
2026年5月7日,Canvas 学习管理系统遭 ShinyHunters 黑客组织攻击,在美国学校期末周引发大面积中断。表面看,这像是一场典型的数据泄露与勒索事件;但如果把时间点、平台性质和学校对 Canvas 的依赖程度放在一起看,它更像一次对现代教育基础设施脆弱性的集中暴露。当一套云端学习系统同时承载课程、作业、成绩、考试和师生沟通时,它就不再只是一个软件服务,而是学校日常运行的一部分。
Anthropic发布Claude Mythos Preview,能够自主发现并利用软件漏洞,已在所有主流操作系统和浏览器中发现数千个高危漏洞,通过Project Glasswing向约40家科技公司提供受控访问,欧盟财长紧急要求获得访问权限。五眼联盟六大网络安全机构联合发布首份Agentic AI安全指南,警告AI Agent存在攻击面扩大、权限蔓延和行为失准等系统性风险。微软发布《从能力到责任》白皮书,提出前沿AI时代网络安全五大建议。
Anthropic发布Project Glasswing联合12家科技巨头保护关键基础设施,Claude Mythos模型发现数千高危漏洞,对工业控制系统和能源基础设施安全敲响警钟。Qualcomm在Investor Day 2026宣布工业AI和物理AI战略,布局千兆瓦级数据中心、6G和智能体工作负载。Merics发布深度报告分析中国具身智能机器人产业雄心,深圳发布"AI+先进制造业"行动计划。AI辅助安全扫描发现存在9年的Linux内核漏洞,工业Linux系统面临紧急补丁需求。
Mozilla 在 Firefox 150 版本中一次性修复了 271 个由 Anthropic Mythos 模型发现的安全漏洞。这不只是一个数字,它标志着软件安全审计正式进入 AI 工业化时代——防守方第一次有了赢的可能。
国际人工智能领域的焦点高度集中在网络安全风险与大模型在垂直科研领域的能力突破上。Anthropic尚未公开发布的Claude Mythos模型因其极其强大的漏洞挖掘能力,引发了美国白宫、欧洲央行及全球金融界的强烈震动。同时Anthropic发布了Claude Opus 4.7及视觉协作工具Claude Design,OpenAI则推出了GPT-Rosalind进军生命科学。
Anthropic Mythos模型引发国家级金融安全预警,美国财政部与美联储紧急磋商;Anthropic与OpenAI在AI责任法案上公开对立;CoreWeave因算力合作股价暴涨40%;Workday核心高管流失至Anthropic,传统SaaS面临底层替代危机。
全球人工智能领域见证了前沿技术突破与深层安全焦虑的激烈碰撞。Anthropic因其最新模型Claude Mythos具备极端网络安全风险而拒绝公开发布,惊动美国财政部与美联储;日本四大科技巨头结盟主攻万亿参数物理AI;马斯克xAI起诉科罗拉多州AI法案,Meta推出AI版扎克伯格引发热议。
当 AI 能以近乎工业化的方式低成本挖出操作系统和基础软件中的深层漏洞,传统 SaaS 的护城河和边界安全叙事,正在被快速抽空。Claude Mythos 带来的,不只是技术突破,更是整个软件产业逻辑的震动。
在科技发展的长河中,有些里程碑是大张旗鼓发布的,伴随着炫目的发布会和铺天盖地的营销,而另一些里程碑,则是在一片倒吸凉气的寂静中,被锁进最高安全级别的服务器里。 2026 年 4 月的这几天,整个科技圈和华尔街正经历着后一种震撼。 人工智能初创公司 Anthropic 研发出了他们迄今为止最强大的前沿模型,Claude Mythos Preview。然而,这款模型没有迎来盛大的公测,而是被直接贴上
引言:当AI成为“超级黑客”的提线木偶 在人工智能飞速发展的今天,大型语言模型(LLM)已经跨越了单纯的“聊天机器人”阶段,进化为能够执行复杂任务、调用外部API、甚至管理加密资产的“自主代理(AI Agents)”。为了协调这些代理与外部世界的交互,**LLM路由器(LLM Routers)**应运而生,成为了AI生态系统中的交通枢纽。 然而,如果这个“交通枢纽”从一开始就被设计成了不设防的裸