


日期:2026年9月18日 星期五
今天AI技术方向最值得关注的变化,是企业Agent开始补齐“上线前测试、关键动作人工批准、可信数据入口和持续合规”四类基础设施。Raindrop完成新一轮融资、累计融资达到5000万美元,并同步推出Simulations研究预览,尝试把真实生产流量和既有测试用例重放到拟变更的Agent系统上,在上线前发现异常行为;iProov发布Human Approval and Presence Specification(HAPS)实验规范,要求高风险Agent动作在执行前能够证明“具体的人,确实批准了具体的动作”;Google与联合国系统推出UN System Data Commons,把分散在联合国系统内的统计数据整合成AI-ready知识图谱,并通过MCP向AI Agent提供权威数据;Comp AI则完成3400万美元A轮融资,把安全政策编写、审计证据收集、控制项持续监测和AI渗透测试做成Agent化合规平台。AI产业正在从“Agent能不能行动”进一步转向“行动之前能不能测试、行动时能不能授权、数据是否可信、行动之后能不能审计”。
9月17日,AI可靠性创业公司Raindrop宣布完成Series A融资,累计融资达到5000万美元,本轮由CRV领投,Lightspeed、Y Combinator等既有投资方继续参与。公司同时公布Simulations研究预览,重点不是再做一个Agent框架,而是解决Agent系统上线前最难回答的问题:改了Prompt、模型、工具链或Harness以后,真实用户任务会不会出现新的异常。
Simulations的思路,是把现实生产环境中的任务流量与既有测试样本重新播放到候选Agent版本上,再用异常检测找出和原版本相比出现的行为偏移。传统软件可以通过单元测试判断一个函数是否返回正确结果,但Agent经常需要持续几小时甚至几天、调用成百上千次工具,中间还可能遭遇第三方API变化、工具超时、上下文漂移和模型版本调整。单个测试用例很难覆盖这种组合风险。
这类“Agent仿真测试”值得关注,因为企业AI正在从Demo进入长周期自动化。未来真正成熟的Agent发布流程,很可能类似现代软件的CI/CD:每一次模型、Prompt、Tool或Policy变更,都先在一组真实历史任务上回放,比较成功率、异常率、工具调用路径和成本,再决定能否进入生产。
Raindrop代表的是一个很小但关键的长尾赛道——Agent Reliability Engineering。模型越自主,企业越需要独立于模型厂商的监控、仿真、回归测试和事故复盘基础设施。
9月17日,身份验证厂商iProov开源发布Human Approval and Presence Specification(HAPS),采用Apache-2.0许可证,并提供部分Rust参考实现与测试向量。HAPS试图解决一个越来越现实的问题:一个Agent拥有账户权限,并不等于某个具体高风险动作真的得到了负责人的授权。
HAPS并不要求所有Agent动作都人工确认,否则自动化就失去意义。规范建议由组织定义哪些动作属于高风险,例如大额支付、修改权限、删除关键资源、发送敏感信息等。一旦触发此类动作,系统需要暂停执行,向用户展示Agent准备执行的准确内容,获得真实人员存在与批准的证明,再验证“批准内容”和“实际执行动作”是否一致。
这比普通“弹一个确认框”严格得多。未来攻击者可能劫持Agent、篡改工具调用参数,甚至诱导用户批准与最终动作不一致的操作。HAPS希望把人的身份、存在性和具体事务绑定起来,让企业在事后可以证明:谁批准了什么、批准时看到的是什么、最终执行的又是什么。
这意味着Agent治理正从“人类在回路中”走向“人类批准可验证”。对于金融、医疗、政务和企业运维等高风险场景,未来Agent权限体系可能不仅需要OAuth和RBAC,还需要关键动作级别的可验证授权证据。
9月17日,Google与联合国系统共同推出UN System Data Commons。该平台建立在Google Data Commons技术之上,把联合国系统内分散在不同机构、格式和统计口径中的公开数据整合到统一、互联的知识图谱中,并提供自然语言检索和交互式可视化。
与普通搜索引擎最大的差别,是平台强调数据由联合国系统统计人员和技术专家参与验证,用户可以追溯数据来源。Google还明确提出通过Model Context Protocol(MCP)让AI Agent直接获取权威统计数据,并自动生成图表、报告和分析草稿。联合国系统计划到2027年纳入约80%的系统统计数据集。
这一变化对研究型Agent很重要。当前很多AI分析最大的风险不是语言能力不足,而是数据来源不稳定、单位和口径不一致,或者模型在搜索结果之间自行拼接出错误结论。如果权威机构把数据直接组织成机器可读取、可追溯的结构,Agent就有机会减少“搜网页—抄数字—再猜含义”的过程。
从技术趋势看,下一阶段AI数据基础设施可能不是简单建设更多向量库,而是让权威数据源本身变成Agent可调用的“可信工具”。政府统计、科研数据、企业主数据都可能沿着类似路径被重构。
9月17日,安全与合规创业公司Comp AI宣布完成3400万美元A轮融资,由Roo Capital与Grand Ventures领投,累计融资约3750万美元。公司把SOC 2等过去高度依赖人工的合规工作拆成Agent工作流:起草安全政策、收集审计证据、持续监控控制项,并进一步扩展到AI渗透测试和基础设施漏洞发现。
Comp AI强调,Agent不会替代独立审计和最终人工判断。例如AI可以先起草政策,但仍由人审核批准;越是后果严重的动作,越需要更高等级的保护和人工确认。这个设计反映了企业Agent比较现实的落地方式:先自动化证据收集、检查和准备工作,再逐步扩大执行权限。
安全合规行业尤其适合Agent,因为很多工作本身就是重复地读取系统状态、比对控制要求、整理证据和追踪变化。真正困难的是“持续性”。一家企业刚完成SOC 2审计,两周后可能上线一个能够读取客户数据、修改权限的新Agent,传统年度审计并不能及时反映风险变化。
因此,Agent本身正在推动合规模式从周期性检查走向Continuous Compliance。未来安全平台需要回答的不只是“今天符合标准吗”,而是“哪个Agent刚获得了什么权限、做了什么、是否越界,以及变化是否会让控制项失效”。
今天四条新闻分别补上了Agent生产体系的四个缺口:Raindrop解决“上线前是否可靠”,HAPS解决“高风险动作是否真的由人批准”,UN System Data Commons解决“Agent拿到的数据是否可信”,Comp AI解决“运行之后是否持续合规”。AI竞争正在从模型能力进一步下沉到工程制度。真正进入企业生产环境以后,可测试、可授权、可追溯和可持续审计,会和模型能力一样成为基础指标。
- Business Wire / Raindrop|《Raindrop Announces Series A and $50M in Total Funding Led by CRV to Protect the World from AI Agent Failures》|2026-09-17|核验融资与Simulations研究预览。
https://www.businesswire.com/news/home/20260917786051/en/ - Business Wire / iProov|《iProov Publishes HAPS, an Experimental Specification for Verifying Human Approval of AI Agent Actions》|2026-09-17|核验HAPS发布时间、用途与开源方式。
https://www.businesswire.com/news/home/20260917276267/en/ - iProov|《HAPS: Verifying Human Approval of AI Agent Actions》|2026-09-17|核验Apache-2.0、Rust参考实现与高风险动作批准流程。
https://www.iproov.com/press/haps-specification-human-approval-ai-agent-actions - Google|《Making global data easier to explore》|2026-09-17|核验UN System Data Commons、知识图谱、MCP和2027数据目标。
https://blog.google/innovation-and-ai/technology/ai/google-un-data-commons-platform/ - United Nations Web TV|《Briefing on the United Nations System Data Commons》|2026-09-17|交叉核验联合国系统数据平台定位。
https://webtv.un.org/en/asset/k1d/k1dzd1svin - TechCrunch|《Comp AI sets eyes on a continuously agentic future for security and compliance》|2026-09-17|核验3400万美元A轮、产品和人类审核机制。
https://techcrunch.com/2026/09/17/comp-ai-sets-eyes-on-a-continiously-agentic-future-for-security-and-complaince/ - Opal Security|《Opal Security Launches Opal Zero to Make Least Privilege a Reality for Enterprise AI Agents》|2026-09-17|背景资料,观察Agent即时最小权限治理。
https://www.opal.dev/media-press/opal-zero-launch - Opal Security|《Introducing Opal Zero: Q&A with CPO Sameer Mehta》|2026-09-17|补充Agent访问决策与零常驻权限趋势。
https://www.opal.dev/blog/introducing-opal-zero-qa-sameer-mehta

关注高促会新质生产力工委会公众号

关注工业智能算网平台
发布日期:2026-09-18
发布机构:中国高技术产业发展促进会新质生产力工作委员会
本报告仅供行业研究参考,不构成投资建议