Codex如果不再“做完即走”:常驻智能体会怎样改变软件工程
WIRED 根据代码内容报道,OpenAI 正在测试 Codex 的 Persistent mode,使代理能够持续工作直到被休眠,并主动创建跨会话后续任务。OpenAI 确认相关功能处于测试阶段,但尚未给出近期上线计划。常驻能力并非简单延长一次运行时间,它要求任务队列、长期记忆、事件触发、权限租约、成本预算和审计机制共同重构。软件工程团队可能因此从“向 AI 提交一次任务”转向“管理一组持续工作的数字工程角色”。
WIRED 根据代码内容报道,OpenAI 正在测试 Codex 的 Persistent mode,使代理能够持续工作直到被休眠,并主动创建跨会话后续任务。OpenAI 确认相关功能处于测试阶段,但尚未给出近期上线计划。常驻能力并非简单延长一次运行时间,它要求任务队列、长期记忆、事件触发、权限租约、成本预算和审计机制共同重构。软件工程团队可能因此从“向 AI 提交一次任务”转向“管理一组持续工作的数字工程角色”。
OpenAI披露,少量Codex任务中出现了超出用户要求的破坏性操作,最严重的模式涉及临时目录清理命令误指向用户文件。事件把一个具体问题摆到开发团队面前:代理执行删除时,系统究竟检查命令文本,还是检查展开后的真实路径与影响范围?
Codex在固定GPU内核竞赛中完成上千轮自动试验,交出232倍加速成绩。本文拆解QR分解、CUDA/Triton优化、基准过拟合、数值验证和生产泛化之间的工程边界。
OpenAI 最新官方博客发布 GPT-5.6 模型族。本文转写其核心信息,并分析 Sol、Terra、Luna 与 ultra 模式背后的产品方向。
V2EX 上关于“深度 Vibe Coding 两个月、三百多亿 Token”的分享,真正有价值的不是用量数字,而是一套严肃项目中的 AI 编程组织方法。
V2EX 关于 Codex 项目上下文的讨论,指向一个更工程化的问题:如何让 AI 不再每次都像新来的开发,而是逐步理解项目结构、业务约定、代码风格和历史决策。
自主编码 Agent 不能只靠模型自述判断是否完成。没有 evaluator,loop 只是生成、解释、宣布完成;有 evaluator,目标、过程和产物才会被证据闭合。
AI 编程让单次改动的代码量变大,逐行审 diff 的性价比会下降。更合理的做法,是把审查前移到计划:目标、边界、接口、数据模型、风险和验证路径。
Oracle 最近发布的技术博客,把 AI Agent 连接数据库这件事推进到了一个更具体的位置。它演示如何把 OpenAI Codex 连接到 Oracle Autonomous AI Database MCP Server,让 Codex 通过 MCP 协议访问数据库工具、查看 schema、获取元数据,并在受控权限下执行数据库工作流。
今日国际AI技术动态呈现出三条主线:第一,智能体工具继续向移动端、远程环境和企业治理体系延伸,OpenAI把Codex带入ChatGPT移动端,Google Cloud继续围绕企业级智能体开发平台强化治理、身份和互操作标准;第二,AI安...