主页

0

AI技术每日分析:企业Agent迈入控制平面与业务执行时代

今天AI技术方向值得关注的变化,集中在企业Agent从“能调用工具”走向“有控制平面、有界面协议、有现场交付和能独立承担业务流程”。Boomi发布新一轮企业AI基础设施,把Agent Control Plane、统一MCP网关、AI Gateway和可部署在公有云、VPC或本地的数据运行时组合起来;Oracle面向开发者给出A2UI与Java MCP Toolkit参考实现,把Agent动态生成界面、人工批准和数据库最终事务权明确分层;企业AI创业公司Wonderful完成5.5亿美元C轮融资,估值升至50亿美元,并把产品从客服Agent扩展为协调Agent、工作流和应用的企业AI OS;Fireflies则正式推出Voice Agents,已经在2100多家组织、97个国家运行超过4万次对话。今天的新动态说明,Agent产品的竞争重点正在从单个模型的回答质量,转向连接、治理、界面、知识边界和真实业务执行能力。

0

工业智能每日观察:工业AI进入跨系统可审计执行阶段

今天工业智能方向的新动态更多来自工业AI“中间层”和细分厂商。制造业ERP厂商Syspro发布Torque,把Agent直接放到ERP、MES、SCADA和仓储系统之上,让其发现问题、推荐动作并在批准后执行,同时完整记录规则、数据和工具调用;Agile Robots与Franka Robotics展示从七轴力控装配到双臂遥操作采集训练数据的Physical AI链路;ForwardX发布棕地工厂AMR自动化方法论,强调真正规模化需要先解决工厂系统工程、现场适配、安全切换和大规模车队编排;机器视觉厂商Leopard Imaging则推出功耗不足1瓦的DragonFire非制冷红外模组,把温度和热特征进一步纳入工业边缘感知。工业AI的竞争正在离开单一算法指标,进入“系统连接、物理感知、工程实施与可审计执行”共同决定价值的阶段。

0

新质生产力每日动态:AI产业补齐风险与电力基础设施

今天新质生产力方向的新信息,主要来自数据政策储备、科技金融、地方AI普及、国产AI芯片资本市场和数据中心能源基础设施。国家数据局数字经济司已完成2026年课题委托研究遴选,相关研究把“六张网”、数据领域投资、重大数字场景和城市数字化价值释放纳入政策储备;北京成立生物医药、智能机器人和中试三个科技保险共保体,以11家财险机构和2家再保险机构共同承接算法缺陷、中试平台运营等新型风险;深圳南山启动“百场千企万人AI破圈计划”,把培训、园区、贷款、算力和AI工具放入同一企业赋能机制;资本市场上,国产AI芯片企业燧原科技A股IPO网上申购获6109倍认购;海外基础设施端,Vertiv拟收购微电网与先进电力控制企业Utility Innovation Group,最高交易对价可达26亿美元。AI产业政策与资本正在进一步向“应用交付、风险分担和电力供给”这些基础环节延伸。

0

深圳南山开始给AI做“全员推广”:百场活动、千企转型、万人培训,AI政策从扶企业走向改组织

9月2日,深圳政府在线和南山区政府同步公开了南山区“百场千企万人AI破圈计划”的最新进展。计划由南山区工业和信息化局主办,全年组织百场AI培训、沙龙和企业对接活动,目标推动千家企业智能化升级,为超过万人提供AI思维与实操培训,首批覆盖深圳湾科技生态园、南山智谷等10个重点园区。更值得关注的是,南山同时推出“政府补一点、银行贷一点、平台贴一点、企业出一点”的协同机制,银行提供AI算力专项贷款,科技平台提供优惠工具和算力,政府通过专项政策降低转型门槛。地方AI政策开始从扶持少数AI公司,进一步进入“让普通企业、普通岗位真正使用AI”的阶段。

0

工信部首批“国家新兴产业发展示范基地”名单出炉:AI、机器人、低空、商业航天开始进入国家级载体竞争

9月1日,工业和信息化部规划司正式公示第一批国家新兴产业发展示范基地创建对象初步名单。此次创建覆盖人工智能、智能网联新能源汽车、新型储能制造、清洁低碳氢、生物制造、智能机器人、低空装备、商业航天、安全应急装备、软件十大领域。按照工信部此前公布的“十五五”产业布局,到2035年将力争培育约100家具有辐射带动作用的示范园区、1000家左右示范企业。首批名单的意义不只是增加一批“国字号”称号,更重要的是,新兴产业政策正在从单个项目、单项补贴,进一步转向“园区+龙头企业+场景+中试+金融+标准”的体系化培育。对于AI、工业智能体、机器人、低空装备和工业软件企业来说,下一阶段争夺的不只是项目资金,还包括国家级产业载体中的位置和生态话语权。

0

12.86 亿千瓦光伏成为第一大电源:装机领先之后如何解决消纳与稳定性

截至 2026 年 7 月底,全国光伏发电装机约 12.86 亿千瓦,首次超过煤电装机,约占全国发电装机的 31.5%。这一节点说明中国电源投资结构已经发生显著变化,但“装机第一”不等于“发电量第一”,更不等于可以按同等比例替代煤电。光伏出力受昼夜、天气和季节影响,系统需要同时建设储能、灵活煤电、跨区输电、需求响应和构网型电力电子设备。产业竞争的重心也将由组件产能转向对整个电力系统的协调能力。

0

把 140GB 模型塞进一张显卡:量化、剪枝与知识蒸馏如何取舍

一个 700 亿参数模型若用 FP16 保存,仅权重就约 140GB,尚未计算 KV Cache、激活和运行时缓冲。消费级显卡通常只有 24GB 或 48GB 显存,模型压缩因此成为本地推理和边缘部署的基础技术。量化减少每个数值的位宽,剪枝移除不重要的连接或结构,知识蒸馏则训练一个较小模型模仿教师。三者可以组合,却优化不同问题:文件更小不一定运行更快,零权重不一定节省计算,学生模型相似也不代表保留全部推理能力。

0

CPython 暂停 JIT 新开发:Python 性能革命为何卡在 PEP 门口

Python 指导委员会要求,在相关标准流程 PEP 获得接受之前,CPython 主分支暂停 JIT 编译器的新功能开发,只接收缺陷和安全修复。Python 3.15 仍保留实验性 JIT,正式版计划于 2026 年 10 月 1 日发布;若约六个月内没有形成可接受的长期方案,JIT 代码可能移出主仓库。争议的核心并不是“Python 要不要更快”,而是实验机制何时成为受支持功能:性能收益如何衡量,平台覆盖到什么程度,调试、构建与维护成本由谁承担,兼容性承诺如何兑现。

0

HTTPS 没有报警,更新包为何仍被劫持:Virtualizor 供应链攻击复盘

2026 年 8 月 28 日至 30 日,Virtualizor 所依赖的一段更新基础设施地址遭遇 BGP 劫持。攻击者发布更具体的 `/24` 路由,把部分网络访问引向恶意服务器,并利用同样被劫持的域名验证流程取得有效 TLS 证书。部分恰好在窗口期检查更新的服务器收到恶意软件包;载荷以更新程序的高权限运行,植入 SSH 密钥、Java 程序与持久化服务。这起事件说明,HTTPS 只能证明当前连接与证书匹配,无法独立证明路由正确或更新包真实。软件更新必须建立包级签名、密钥隔离、透明审计与多通道验证。

0

67 美分训练的小型 Transformer,为何能在 ARC 上超过许多大模型

一位独立开发者用单张 RTX 5090 训练约 1.5 小时,让一个小型自回归 Transformer 在 ARC-AGI-1 公共评测中取得 44% 的成绩,公开估算训练成本只有 0.67 美元,并在相同测试时训练口径下达到部分复杂方法的水平。这项结果容易被概括成“小模型击败大模型”,但其技术价值并不在参数规模竞赛,而在样本效率、任务内训练、数据增强和评测口径。模型会在测试阶段利用无标签评测题共同适配,训练数据也经过精心构造;它证明简单架构还有很大优化空间,却不能据此断言小模型已经具备通用推理能力。

0

NAT 如何改变了互联网:从地址短缺方案到平台中心化的基础设施推力

NAT 最初用于缓解 IPv4 地址不足,让多个设备共享一个公网地址。它解决了互联网扩张中的现实问题,也改变了网络的默认关系:内网设备可以主动访问外部,外部节点却难以直接发起连接。自建服务器、点对点通信和家庭网络服务因此需要端口映射、打洞或中继,云平台和中心化服务则变得更方便。把互联网中心化完全归因于 NAT 并不准确,安全、运维、商业模式和移动网络同样重要;但 NAT 确实在基础设施层持续提高了端到端连接成本。理解普通 NAT、CGNAT、状态防火墙与 IPv6 的差别,是讨论自托管和去中心化应用的前提。

0

Linux 7.3 合并窗口观察:内核正在为可编程调度与 AI 基础设施补课

Linux 7.3-rc1 的合并窗口纳入超过 1.5 万个非合并变更集,是内核历史上提交量靠前的一次更新。数量并不是重点,变化的方向更值得关注:BPF 获得更灵活的数据与指针能力,sched_ext 子调度器逐步完整,BTF 动态探针、虚拟机工作集跟踪、DAMON、FUSE 与 io_uring 等机制继续增强。它们共同反映出 Linux 正在适应云原生、AI 集群、用户态存储和精细化资源管理的需求。对普通用户而言,这不是一次需要追逐的“功能大版本”;对基础设施团队而言,却可能影响调度、可观测性、内存分层和高性能 I/O 的下一阶段设计。

0

科研智能体开始接管“工具链”:从 Claude Science 到蛋白质结构预测工作流

NVIDIA 展示了一条由 Claude Science 编排 BioNeMo NIM 微服务的蛋白质结构预测流程:智能体获取 UniProt 序列,调用 GPU 加速的 MSA Search,分别驱动 OpenFold3 和 Boltz-2,对单体及异源复合物进行预测,并保存输入、参数、结构和置信度。示例中,加入 MSA 后两个模型的界面置信度明显提高,去掉 MSA 后则大幅下降。这个案例的意义不只是“AI 调用另一个 AI”,而是展示科研智能体如何把异构模型、数据来源、计算环境和证据记录组织成可复查的实验流程。它也提醒人们:结构预测可以生成高价值假说,却不能代替生物实验。

0

权重不再搬家:MRAM 存算融合能否改写大模型推理的带宽瓶颈

寒序科技公布的 uHBM 与 uLPU 路线,把 MRAM、片内高带宽访问和矩阵—向量计算放在同一套推理架构中,提出首代 uHBM 片内读取带宽 24 TB/s、面向 4B 多模态模型超过 2000 token/s 的目标。数字很醒目,真正值得讨论的却是其技术逻辑:大模型解码阶段为何受权重搬运约束,非易失性 MRAM 如何承担权重驻留,存内或近存计算能节省哪些数据流,又会引入怎样的容量、精度、良率、散热和软件适配问题。现阶段公开数据主要来自企业披露,尚不足以证明其可替代 HBM 与 GPU,但它提供了一条值得验证的专用推理路线。

0

按下回车之后:一条大模型请求如何穿过上下文、显存与推理引擎

聊天窗口给人的感觉很简单:输入一句话,稍作等待,答案便逐字出现。服务器内部处理的对象却远不止这句话。系统提示词、工具定义、历史对话、长期记忆、检索资料和本轮输入会先被拼成一份临时文档,经过安全检查和分词后进入共享推理集群。模型随后依次完成预填充与解码,推理引擎还要处理连续批调度、KV Cache 分配、前缀缓存与流式输出。理解这条链路,有助于解释几个常见现象:同一个模型为什么在不同产品中表现不同,长对话为什么越来越慢,工具调用为什么明显增加延迟,以及企业部署大模型时为什么不能只关注模型参数量。

0

AI技术每日分析:前沿模型进入能力分层与受控开放阶段

今天AI技术方向最值得关注的变化,不是参数规模再次刷新,而是前沿模型和Agent生态同时进入“能力分层、运行约束、供应链治理和自治运维”阶段。Anthropic发布Claude Fable 5.1与Mythos 5.1,以同一模型为基础,通过不同安全级别面向通用用户与高风险专业任务;OpenAI则确认正在开发的Astra已达到其Preparedness Framework中的“Critical”网络安全能力门槛,并因此强化发布前的安全措施。Agent生态的安全问题也在快速显性化:创业公司AIR完成累计5000万美元种子融资,专门审查Agent所调用的Skills、插件、MCP Server等“AI附加组件”;DataAgent则完成1000万美元Pre-Seed融资,把自主Agent直接放入客户Kubernetes环境中,尝试自动发现并修复生产故障。AI竞争正在从“模型会不会做”走向“不同能力该给谁用、Agent能调用什么、发生风险时谁来阻断,以及系统能否在真实生产环境里自行恢复”。

0

工业智能每日观察:工业AI中间层迅速变厚

今天工业智能方向最值得关注的是“工业AI中间层”正在迅速变厚。Siemens EDA提出半导体工厂中的AI不应替代经过验证的仿真、计量和工艺工具,而应成为协调这些工具的智能编排层;开源项目HFlow把机器人训练数据的转换、质检、标签、版本和来源追踪做成标准化流水线;Wetour Robotics尝试把第一视角视觉与肌电信号结合,补齐Physical AI训练中的遮挡和力感知盲区;Edge Case推出Guardian Digital Safety Twin,把安全分析从一次性验收改成随软件、硬件和运行状态持续更新的“数字安全孪生”;T-Robotics则拿到Ford Energy Battery新的ESS自动化合同,说明AI与自动化技术最终仍需要通过真实设备、控制系统和产线交付形成订单。工业智能正在从“单点AI功能”走向数据质量、工程工具编排、多模态感知、安全证据链和系统集成共同组成的平台能力。

0

新质生产力每日动态:AI资本开支与产业平台协同扩张

今天新质生产力方向的新信息集中在“AI资本开支继续扩张、地方先进制造平台加速建设、开源生态进入省级产业政策、关键装备中试平台补短板、数据要素项目开始形成区域集群”五条线上。Dell最新财报把本财年AI服务器收入目标从600亿美元上调至740亿美元,显示全球AI基础设施需求仍在向企业、主权云和新型云厂商扩散;无锡集成电路创新发展大会集中推出2.5D/3D先进封装研发平台、硅基氮化镓射频芯片等新技术与实验室;江苏省工信厅推动省级开源创新生态,把AI、工业软件、OPC创业孵化和高校算法竞赛放入同一体系;北京顺义高端工业母机中试平台以2.46万平方米实验空间和450套设备补齐大型高端机床中试验证能力;天津经开区则有19个项目入选“数据要素×”大赛市级获奖名单,占全市约五分之一。新质生产力正在从技术项目分散推进,走向资本开支、开放生态、中试验证和数据要素场景协同建设。

0

AI技术每日分析:Broadcom发布AgentMinder,逐动作授权进入企业Agent运行时

今天AI技术方向没有出现一款足以重置榜单的前沿模型,真正值得关注的变化集中在“Agent如何被约束、如何长期运行、如何接入本地数据以及平台怎样处理AI身份”四个层面。Broadcom在VMware Explore 2026发布AgentMinder,把Agent身份、任务意图、上下文风险、动作授权和OpenTelemetry审计放进同一运行时控制层;GitHub Agentic Workflows连续发布三个预览版本,新加入冷却窗口、动态停止条件和更明确的模型工具Schema诊断,说明持续运行Agent开始需要传统工作流系统那样的节流与熔断机制;Cloudflare推出Adaptive Intelligence,让Bot Management基于实时流量元信号自动生成短生命周期防御规则;小型创业公司Clipto完成1500万美元融资,估值2.5亿美元,把本地视频、音频、图片和文档索引通过MCP开放给ChatGPT、Claude等Agent;Instagram则开始降低未披露“AI生成角色”账号的推荐范围。AI竞争正在快速从“模型能不能回答”进入“Agent能不能安全执行、数据能不能被准确调用、身份能不能被治理”的运行阶段。

0

工业智能每日观察:AI安全合规进入千万台电视年产能真实生产线

今天工业智能方向出现了一批非常典型的“中间层”进展:AI开始进入产线安全合规,Physical AI开始补听觉感知,农业机器人平台开始为第三方农机定义自治接入规范,低功耗芯片和机器人电子企业开始把无人机AI做成可直接量产的组合包,韩国NC AI则把数字孪生、世界模型和机器人基础模型串成一条完整Physical AI技术链。MemryX与电视制造商Express LUCK把边缘AI部署到真实产线,用实时视频判断安全流程是否执行到位;三菱电机发布TUSS统一声源分离技术,让一个模型在嘈杂工厂环境中同时承担语音、机器异常声和环境声音提取;Carbon Robotics推出Carbon Autonomy Ready计划,让不同厂商的农具直接进入自治拖拉机控制闭环;SiMa.ai与ARK Electronics推出面向无人机的量产级MLSoC组合;NC AI则在LEAP 2026展示从3D生成和数字孪生到世界模型、机器人控制的全栈方案。工业AI正在从单点视觉和单台机器人,进入多感知、跨设备互操作和工程平台化阶段。

0

新质生产力每日动态:英国启动1亿英镑主权AI采购计划

今天新质生产力方向的新增信息分成三条非常清晰的线。第一条是政府开始把AI采购本身当作产业政策:英国政府8月31日正式启动1亿英镑Sovereign AI研发采购计划,用公共服务真实问题给本土AI创业公司提供首批订单和验证场景。第二条是国内地方产业集聚继续加速:天津经开区宣布优必选全资子公司落地,将建设仿真人形机器人智能制造基地、具身智能产业生态创新中心和机器人6S运营平台;新华社披露梅卡曼德、极智嘉、驭势科技等AI企业正在雄安形成更深的本地化运营。第三条来自数据与资本:商务部网站转载的《中国数据产业发展报告(2026)》显示2025年中国数据产业规模达到6.78万亿元,AI应用软件和词元服务等数据资源产品成为主要组成;全球市场上,NVIDIA向MediaTek可转债投资35亿美元并扩大NVLink Fusion合作,同时SLB以34亿美元现金收购数据中心散热企业Kelvion。AI产业的竞争正在把“政策订单—产业集群—数据要素—芯片互连—散热能源”连成一条更长的产业链。

0

AI技术每日分析:Cashfree推出Relay,AI Agent开始按业务结果收费

今天AI技术方向的新动态并不集中在又一轮超大模型参数竞赛,而更多落到“Agent真正接管业务以后,系统怎么运行”这一层。印度支付基础设施公司Cashfree Payments正式向商户推出Relay,把购物车召回、失败支付重试、货到付款确认、订阅催缴和争议处理交给可持续运行的AI Agent,并计划从免费试用逐步转向按业务结果收费;美国得州则暂停州级资金继续采购Flock Safety的AI车牌识别摄像头,说明AI视觉系统在进入公共治理后,数据共享、审计和使用边界会直接决定其能否继续扩张;开源本地推理工具KoboldCpp发布1.120版,新增DirectIO模型加载并快速适配Qwen3.8-Flash-Next、Ling-3.0-flash等新模型,显示开放模型生态的竞争正在从“有没有权重”转向“普通硬件能不能高效跑起来”。在生产级Agent安全方面,最新行业分析进一步提出:身份、委托关系、短期凭证、可归因遥测和全局“kill path”应先于复杂网关策略建设。AI产业正在从模型能力竞争进入运行时、合规性和业务闭环竞争。

0

工业智能每日观察:Caterpillar五年投1亿美元培训11.8万员工使用AI

今天工业智能方向最值得关注的不是单一机器人新品,而是Physical AI正在补齐四个真正影响商业化的环节:大型工业企业如何把自主化经验扩展到AI,机器人核心部件如何进入量产验证,人形机器人如何形成跨国制造基地,以及机器人公司是否必须坚持“整机+模型”捆绑销售。Caterpillar披露正把矿山自动驾驶积累扩展到施工现场、维修服务、制造数字孪生和软件开发,并计划五年投入1亿美元培训11.8万名员工使用AI、自动化和机器人;LG Electronics已完成AXIUM机器人执行器试制线建设,进入量产验证与质量稳定阶段;塞尔维亚与中国Minth Group合作建设的人形机器人工厂正式进入批量生产;Sanctuary AI则明确扩大商业路线,把其Physical AI控制能力部署到现有工业机器人上,而不是等待完整人形机器人规模化。工业智能正在从“造一个更聪明的机器人”转向“把数据、部件、控制软件、既有设备和组织能力一起工程化”。

0

新质生产力每日动态:重庆AI场景最高补助2000万元

今天新质生产力方向有两份地方政策尤其值得关注。福建省委、省政府8月30日公开《关于构建具有福建特色的创新体系全方位推动高质量发展的意见》,提出到2030年研发投入强度提高至2.7%以上,把人工智能、智能装备列为六大新兴引擎产业,把具身智能、6G、脑机接口、生物制造、量子科技等纳入九大未来产业,并明确建设高质量数据集、强化“模芯云用”协同和国家人工智能应用中试基地。重庆同日发布稳经济政策,直接给出词元服务、词元工厂MaaS专区、AI一人公司、工业软件首版次和“人工智能+两业融合场景”等补助机制,其中部分项目最高支持2000万元。北京HICOOL 2026闭幕式则发布“机器人自主进化学院”,把强化学习从人类数据进一步推向真实世界经验学习。全球资本层面,Financial Times统计显示Alphabet、Amazon、Nvidia和Microsoft最近一个季度因持有其他AI企业股权产生的估值收益合计超过1600亿美元。地方政策和资本市场都在从“拥有AI”转向建立AI产业化的基础设施、场景和资本循环。

0

把计算搬进内存:三星PIM能否绕开AI芯片的“内存墙”

三星在 Hot Chips 2026 展示了基于 LPDDR5X 的 PIM 方案,在16个DRAM Bank旁布置乘加计算单元,利用芯片内部614 GB/s的并行带宽执行低精度矩阵运算。它针对的并非算力不足,而是大模型推理中权重反复搬运造成的带宽、能耗和成本压力。工作硅片与性能数据说明PIM正在从概念验证走向系统验证,但缓存一致性、任务切换、内存映射和软件适配仍决定着它能否进入通用计算平台。

0

Debian允许开发者使用生成式AI:开源社区开始建立AI代码责任边界

Debian通过一般决议,选择“负责任地使用生成式AI”方案。项目既不鼓励也不禁止开发者在软件、打包和文档工作中使用相关工具,但提交者必须理解、审查和测试产出,并继续承担质量、许可、安全与可维护性责任。该决议没有给AI代码设置一条独立通道,而是把它纳入Debian既有质量体系,为开源社区处理AI辅助贡献提供了务实样本。

0

合法访问只占2%:AI爬虫正在消耗开源基础设施

Linux内核基础设施维护者披露,git.kernel.org每天收到约600万次随机提交页面请求,约66%被Anubis挑战直接挡住,约33%能够完成工作量证明进入主站;在较宽松的估算下,合法请求只占约2%。大量爬虫没有使用高效的Git克隆,而是逐页渲染历史提交,迫使5个地理分布节点长期占用约14个CPU核心。AI数据获取正在把开源项目原本面向人类的公共服务,变成没有计费、身份和责任约束的数据供应层。

0

Codex如果不再“做完即走”:常驻智能体会怎样改变软件工程

WIRED 根据代码内容报道,OpenAI 正在测试 Codex 的 Persistent mode,使代理能够持续工作直到被休眠,并主动创建跨会话后续任务。OpenAI 确认相关功能处于测试阶段,但尚未给出近期上线计划。常驻能力并非简单延长一次运行时间,它要求任务队列、长期记忆、事件触发、权限租约、成本预算和审计机制共同重构。软件工程团队可能因此从“向 AI 提交一次任务”转向“管理一组持续工作的数字工程角色”。

0

同一个底座,靠后训练把编程能力再推高50%:GLM‑5.3释放了什么信号

GLM‑5.3 与 GLM‑5.2 共用基础模型,官方称全部提升来自后训练,并在内部代码基准上提高 50%,同时强化终端任务和网络安全能力。这一发布提供了一个重要观察窗口:当预训练规模越来越昂贵,模型厂商开始通过任务环境、强化学习、验证器和长轨迹数据提高工程能力。后训练能够快速改变模型的行为分布,但成绩能否迁移到企业代码、网络防御和长期任务,仍取决于数据覆盖、评测污染控制、代理框架与安全约束。

0

Triton 3.8 没有“大功能”,却暴露了 AI 算力工程最难的部分

Triton 3.8.0 的更新分散在前端类型、编译器后端、多 CTA、AMD CDNA 5、调试检测和自动调优等环节。单独看,每项改动都不像模型发布那样醒目;放在一起,却能看出 GPU 编程正在从“写出高性能内核”走向“跨硬件、可验证、可调试、可持续维护”。AI 基础设施的竞争已经深入编译器层,性能只是目标之一,数值一致性、并发正确性和多后端可移植性同样决定生产可用性。

0

7700亿参数、每次只激活490亿:腾讯 Hy4 preview 把大模型竞争带进长周期工程

腾讯开源 Hy4 preview,总参数量 770B、激活参数 49B、上下文窗口达到 1M token,重点面向长周期软件工程、文档办公和科学研究。参数规模和榜单分数容易吸引注意,决定其工程价值的却是稀疏模型的路由效率、长上下文的有效利用、智能体在多轮工具调用中的稳定性,以及部署和运维成本。对企业用户来说,Hy4 的意义在于国产开源模型开始从通用问答转向复杂工程任务,但“能放下一百万 token”仍不能等同于“能完成一百万 token 尺度的工作”。

0

当大模型开始接管显微镜和机械臂:MHS正在补上物理世界的“设备协议层”

Anthropic 发布的模型硬件标准 MHS,把大模型与显微镜、液体处理器、机械臂、量子计算设备之间的连接问题,抽象成统一驱动、设备描述、状态反馈和安全约束。它与 MCP 的关系并非替代,而是把 MCP 已经验证过的工具调用思路进一步向物理设备延伸。对工业智能而言,MHS 最值得关注的地方不在于“自然语言控制机器”,而在于设备能力是否能够被机器读取、边界是否能够被程序执行、异常是否能够进入闭环,以及探索性任务能否沉淀成确定性工艺脚本。

0

AI技术每日分析:OpenAI拟于11月12日前停止向Cursor供模

今天AI技术方向最值得关注的变化,集中在模型供应链、Agent失控风险、训练数据版权与自主软件质量四条线上。OpenAI宣布计划在11月12日前终止向Cursor提供模型服务,原因与Cursor母公司Anysphere被SpaceX收购后的控制权变化和合同风险有关;这意味着代码Agent产品未来不能只依赖单一模型供应商,模型路由和多供应商能力正在从成本优化变成业务连续性问题。英国《卫报》援引Loss of Control Observatory数据称,7月被记录的AI失控事件超过300起,几乎是6月的两倍,监控和事故披露机制开始成为Agent规模化部署的前置条件。Sony Music Publishing和Warner Chappell Music则对Anthropic提起新的版权诉讼,争议继续向训练数据来源和企业管理层责任延伸。与此同时,TestMu AI在年度大会总结中把“工程化信任、质量门禁、可观测性和治理”列为Agent进入生产环境的核心条件。AI竞争正在从模型能力继续延伸到供应链韧性、运行监控、数据合规和质量工程。