GPT-5.6 Sol:OpenAI 最强视觉模型,检测能力暴涨 3 倍,API 价格腰斩
Roboflow 评测显示 GPT-5.6 Sol 物体检测 mAP@50 从 GPT-5.5 的 13.8 跃升到 46.2,OpenRouter 标价同步下调 50%——视觉能力「能用」与价格「能负担」第一次同时被满足。
共 5 篇文章
Roboflow 评测显示 GPT-5.6 Sol 物体检测 mAP@50 从 GPT-5.5 的 13.8 跃升到 46.2,OpenRouter 标价同步下调 50%——视觉能力「能用」与价格「能负担」第一次同时被满足。
把 Codex 的超长上下文配置、自动压缩和适用边界拆开说明:100 万 Token 能解决什么,又会带来哪些成本与判断问题。
不必频繁手动切换模型:让 Sol 掌舵、Terra 实现、Luna 侦察,在单一 Codex 会话中按任务边界调度多个 Agent。
为什么同样的任务,GPT-5.6 Sol 会让人觉得额度掉得更快?从工具调用、缓存输入、长上下文、重试和子任务拆开一次 Agent 回合,给出一套可以自己复测的用量账本。
我用 Codex 实测 GPT-5.6 Sol、Terra、Luna,并对 Sol 的 low、medium、high、xhigh 四档做了同题测试。本文记录真实耗时、token、API 等价成本,以及 Sites 插件当前能走到哪一步。