技术热点透视20261006:OpenAI 内部报告,Codex 用量每月翻倍、每天烧掉 600 美元
OpenAI 内部报告显示 Codex 用量每月翻倍、中位研究者日推理支出达 601 美元。本文拆解 coding agent 的真实账单,以及比账单更危险的隐患——监督缺口。
共 21 篇文章
OpenAI 内部报告显示 Codex 用量每月翻倍、中位研究者日推理支出达 601 美元。本文拆解 coding agent 的真实账单,以及比账单更危险的隐患——监督缺口。
OpenAI 上线 Dots:常驻自主 agent 拥有自己的云电脑与浏览器,可接入 4000+ 应用并集成 Slack、Teams。本文拆解它的架构、代价,以及那道还没补上的治理缺口。
Tibo 宣布全球额度重置,覆盖所有付费 ChatGPT 账号。附带把「重置不等于送积分」、重置流程化,以及状态页记录与推文口径不一致的部分讲清楚。
OpenAI 给 Pro 200 老用户发了 62,500 积分,官方标注价值 2,500 美元,12 月 31 日过期。为什么给你、别人有没有收到、这笔积分到底值多少,以及这半刀砍在了哪里。
OpenAI dot 实测录屏拆解:它在 8 核 9 GB 的 Debian 13 云虚拟机上做出《一键引力》,公开了源码与测试包,也如实说清了离线设备与未验证的部分。
当地时间 9 月 29 日,OpenAI 在旧金山 Fort Mason 开了今年的 DevDay。Sam Altman 一口气发布 20 多项更新——官方 recap 列的是「20 多项」,第三方媒体数出来是 22 项,而 2025 年那场 DevDay 只有 9 项。
Tibo 宣布重新开放 200 美元 Pro 订阅,同时把用量计算口径减半。拆解他给出的四条理由,以及这次调整真正改变的东西。
2026 年 9 月 26 日,Codex 四条入口同时中断约 56 分钟,报错却是会误导人的 401。复盘时间线、认证层故障与额度用尽的区别,以及 Tibo 为什么用一次全量额度重置来收尾。
今天 OpenAI 把 Agents API 推到了 public beta。表面看,这是「又一个 API 开放」;往里看,这是把驱动 Codex 与 ChatGPT 的那套 agent 基础设施——harness——从
Anthropic、OpenAI、Google 罕见同声呼吁放慢前沿 AI。拆解阿莫迪的三步方案为何没写下一个速度数字,以及真正会让 AI 减速的是电网和折旧表,不是董事会的新闻稿。
GPT-6 Astra 上线十天,OpenAI 砍额度、发重置卡、暂停 200 美元套餐新订阅、下线 Spark。本文盘点社区证据、拆解四层工程原因,并分析官方接下来会怎么做。
9 月 12 日凌晨,25 位菲尔兹奖得主(含 2026 新科得主邓煜、Deligne、吴宝珠)联名公开信,抨击 OpenAI、Anthropic 把攻克千禧年难题当基准与 IPO 前公关素材,称其伤害数学共同体。争议核心不是「AI 能不能做数学」,而是当自主研究 Agent 跑出证明,跑了三百年的优先权、署名权、同行评议制度是否还成立;数学界本周重新撞上的「身份/授权/审计/信用」四问,与生产级商业 Agent(蚂蚁 APASS/KYA)要解的是同一组治理难题。
2026 年 9 月 10 日 OpenAI 开放 Agents API 公测,把驱动 Codex 的 harness 作为托管服务交给开发者:单端点创建生产级云 agent,OpenAI 负责会话保活、上下文自动压缩、故障恢复与子 agent 协调,执行环境可选托管沙箱、自有基础设施或九家合作方。本文讲清基本介绍、优点、缺点、六个坑、安全与数据边界(美国驻留、不支持 ZDR),并用可复现的成本模型算出容器空转、缓存重算 12.5 倍、272K 定价悬崖、子 agent 放大 4.54 倍等真实数字,最后回答个人开发者到底用不用得上、什么场景值得上。
OpenAI 内部智能体给出 Navier-Stokes 受迫爆破候选证明,Lean 形式化验证,与一场关于算力与学术伦理的抢发争议
拆解曾鸣访谈里“模型公司就是 AI 云公司、同质化供给无高利润”这条推理链:同质化不是物理定律,真正决定利润池的是计价单位——从 token 到 outcome 的迁移。
OpenAI 把内部账本亮了出来:截至 2026 年 8 月中旬,每 1 个人类研究工作日,公司内部同时跑着 3.1 个 AI Agent 工作日——半年前还不到 1,6 月前 Agent 总运行时间仍低于人类总劳动,6 到 8 月之间天平翻了过来。中位数研究员日均推理算力约 600 美元,第 90 百分位每天烧掉超 7000 美元 token。Agent 真正站稳的不是宏大战略规划,而是研究中间那段不性感的苦活:写基础设施、跑和监控训练、排障。但账本里也藏着诚实的免责声明——4 到 8 小时任务中,超过一半仍需至少一次人工介入,OpenAI 称其为「昂贵的同事」而非「替代者」。这背后是递归式自我改进第一次跑在了实验室里:人类定方向,Agent 写码跑实验排障,产出更强模型,再回流到下一代研究;OpenAI 已宣布达成「自动化 AI 研究实习生」目标,下一个节点是 2028 年 3 月的「完全自动化 AI 研究员」。前沿的比赛早已不在 benchmark 分数,而在生产级 harness、安全边界与经济账。
GPT-6 Astra 在 9 月 3 日发布、9 月 4-5 日放量到 ChatGPT Work / Codex / API 后,真正的变化不是「又出了个更强的模型」,而是它直接装机进 coding agent 的 harness:Codex 跨窗口持久记忆、给写 PR 的 agent 加语音对话、Cognition 把 Astra 塞进 Devin 在 FrontierCode 上逼近 Fable 5 而成本低 64%。同一天 Claude Code 周限额重置。模型厂不再只卖 API,开始亲手把模型做成「会写代码的 agent」——coding agent 的护城河正从「模型强」挪到「harness 强」:上下文记忆、工具编排、模型路由、护栏、可观测才是难复制的部分;而成本曲线上单模型单价在涨、编排却把每任务成本往下拉,开发者最终为「性价比」而非「榜单」买单。
OpenAI 发布 GPT-6 Astra 并高调宣布 AGI 时代到来。本文从跑分争议、AGI 定义、行业格局与七个值得关注的方向,深入分析通用人工智能的现状与趋势。
9 月 2-3 日 AI coding 观察:OpenAI 通知 11/12 终止向 Cursor 提供模型(SpaceX 600 亿美元收购 Anysphere 触发变更控制条款,被指 xAI/X 违约),Cursor 仅 5% 流量依赖、Anthropic 加码;智谱入驻天猫开售 GLM Coding Plan(基于 GLM-5.3,适配 ZCode/Claude Code/Codex 等 20 余款工具,Pro 538 元/月较年初涨 3.6 倍),把「卖 Token」做成零售;阿里 Qwen3.8-Max 登顶 CodeArena 前端编程(1691 分超 Opus 5 / Kimi K3,1M 上下文,$2/$6);OpenAI 同期 API 降价(GPT-5.6 Luna −80%)。结论:coding agent 2026 是供应链重构年,护城河从「模型接入」转向「自有模型 + 场景绑定 + 部署形态」。
8 月 30 日 AI coding 供应链观察:OpenAI 因 SpaceX 收购 Cursor 将于 11/12 切断未来模型访问;GitHub Codex 修复 8 类 token 浪费 bug 后同一 quota 可多干 10%–50%;Benzi 确定性 coding agent 用 tree-sitter 代码地图在 SWE-bench Verified 拿下 78.2%,仅读 9,125 行、成本 $37.33。结论:coding agent 的护城河正从模型智商滑向供应链韧性、token 经济学与结构化代码理解。
OpenAI 因 SpaceX 收购 Cursor 而切断模型供应,撕开 AI 模型供应链的信任裂痕;分析阵营化趋势,并论证 DeepSeek 开放权重模型作为备选的价值。