Codex 怎么开 100 万 Token 上下文?一篇帖子讲清「长记忆」的甜与苦
把 Codex 的超长上下文配置、自动压缩和适用边界拆开说明:100 万 Token 能解决什么,又会带来哪些成本与判断问题。
共 125 篇文章
把 Codex 的超长上下文配置、自动压缩和适用边界拆开说明:100 万 Token 能解决什么,又会带来哪些成本与判断问题。
DeepSeek Harness 为什么能把模型、工具、会话和界面做成可组合的插件?从 Cordis 的 Context、inject、事件与可逆副作用,拆开这层 Agent 运行时底座。
DeepSeek Harness 的开源热度背后,值得关注的不是一串 Star,而是 Agent 运行时会不会成为模型、工具和开发者之间新的长期入口。
腾讯参投 Lovable 的 4 亿美元 C 轮,把 AI 编程赛道重新摆上牌桌。本文从这次融资切入,盘点 Claude Code 与 Codex 的双雄对峙、Cursor 被 SpaceX 收编、Windsurf/Devin/v0/Bolt.new/Replit/Copilot 等旧神新贵的现状,拆解腾讯自研加投资的双线布局,最后给出对 AI 编程工具未来走向的三个判断。
从李开复在《人民日报》的署名文章出发,拆解“AI 变革不是工业革命 4.0”这一判断:手与脑的维度差异、扩散速度差异、局部优化与系统重构的深度差异,再看 2026 年智能体与成本曲线的实际进展,最后落到对个人的三条生存法则。
用菜谱、便利贴、缩略图这些生活化类比,讲清大模型里权重、激活、KV 缓存、量化与采样到底在做什么,以及一次生成请求背后的完整链路。
从 Cactus Compute 的 Needle 2 说起:4500 万参数、14MB 单文件、28MB 内存,跑在 ESP32 上的开源语言模型。梳理超小设备跑 AI 的现状、同类玩家、发展趋势,以及它对“小”的重新定义和给开发者的建议。
用真实环境、过程合规与工作流路由三条尺度,重新审视 Agent 评测分数在工程选型中的意义。
从过程越界、错误恢复到多 Agent 网络协议,梳理 Agent 安全与可信系统的三层护栏。
DeepSeek 把 Harness 以 dsh 开源。本文从源码拆开 Cordis 插件树、事件溯源会话、工具执行流水线、上下文压缩、沙箱与子 Agent,判断它究竟是一款编程助手,还是一个可替换的 Agent Runtime。
核对 DeepSeek V4 Pro 正式版的 1M 上下文、384K 最大输出、API 价格与官方 Codex 配置脚本,并判断已有本机配置在什么情况下需要更新。
从工具 schema、长上下文与 GUI 视觉 token 三层,梳理 Agent 系统的主要成本来源和可落地优化。
从冲突建模、群体审议和门控聚合三个方向,讨论多 Agent 协作何时值得使用。
围绕技能获取、训练环境与层级技能库,梳理自进化 Agent 从经验到可复用能力的关键设计。
Agent 能发现彼此、调用彼此,并不代表它们有办法验证对方的能力声明。本文借“柠檬市场”分析开放智能体网络中的信息不对称,以及信号、筛选和声誉机制如何补上一层信任。
David Silver 与 Richard Sutton 认为,AI 的下一阶段将从模仿人类数据转向在环境中持续行动和学习。本文梳理“体验时代”的四个特征,并讨论奖励设计、长期智能体与安全边界。
2026 年 8 月,OpenAI、Amazon、Cursor、Microsoft、Vercel 联合发布 Agent Plugins 1.0:一个把 Agent Skills 和 MCP 服务器打包成可移植插件的目录格式。本文拆解规范本身的边界设计、治理结构,再讨论三个真正的缺口:信任模型、Anthropic 缺席,以及“包能搬家但行为不能”。
MCP 解决了 Agent 怎么调用工具,ARD 解决的是更早一环:Agent 怎么找到工具。2026 年 6 月 Google 联合微软、GitHub 等发布 ARD 规范,核心是域名下的 ai-catalog.json 和聚合注册中心。本文拆解 Catalog/Registry 机制、与 MCP/A2A 的分工,以及验证机制背后的供应链安全账。