分类: 人工智能

共 148 篇文章

文章列表

Agent 开始动真实世界了:离开沙箱前,它必须拿到三把钥匙
原创 人工智能 · 工程实践 · 阅读

Agent 开始动真实世界了:离开沙箱前,它必须拿到三把钥匙

8 月最后一周 AI 信号:Anthropic 模型硬件标准、Pasqal 量子 Vibe Coding(仿真→真机)、OpenAI 常驻 Agent 与失控事故、具身智能标尺切换。Agent 的下一关不是更聪明,是敢不敢动真实世界——取决于接口标准、验证闸门、可信边界三把钥匙。

RRL 入门:让大模型不再忘记好点子
原创 人工智能 · 工程实践 · 阅读

RRL 入门:让大模型不再忘记好点子

RRL(Retrospective Replay-based RL)通过价值模型识别、重放缓冲区和周期性重放,把在线强化学习训练中被遗忘的高质量探索样本重新利用,解决模型训练后期探索退化的难题。

可插拔、有身份、能交付:这一周,Agent 长成了基础设施
原创 人工智能 · 工程实践 · 阅读

可插拔、有身份、能交付:这一周,Agent 长成了基础设施

8 月 17–27 日 AI 信号汇总:Agent Plugins 1.0 跨厂商可移植、MCP 给 agent 发身份证、成都贡嘎一号无遥控全自主长时序、Orchard 开源环境层。Agent 正从一次性聪明脚本进化为可插拔、有身份、能交付的公用设施。

后训练入门:让大模型从「懂语言」到「会干活」
原创 人工智能 · 工程实践 · 阅读

后训练入门:让大模型从「懂语言」到「会干活」

后训练(Post-training)入门教程:预训练 vs 后训练的区别、SFT/RLHF/DPO 三种主流方法、什么场景适合做后训练(配 6 个真实案例)、什么场景不该做、工具推荐与最小可跑案例,面向工程师的速查指南。

跑赢博尔特,37 队弃赛:这一天全行业在重写记分牌
原创 人工智能 · 工程实践 · 阅读

跑赢博尔特,37 队弃赛:这一天全行业在重写记分牌

8 月 26 日 AI 三战场同现反差:人形机器人百米 9.32 秒超博尔特却仅 26% 完赛,Claude-opus-5 仓库迁移 47/100 但全阶段通过仅 5.4%,99% 企业计划部署 Agent 仅 9–14% 投产。行业正在从比峰值转向比完成率,重写记分牌。

AI 不再只是聊天:8 月,一场关于「闭环」的战争已经打响
原创 人工智能 · 工程实践 · 阅读

AI 不再只是聊天:8 月,一场关于「闭环」的战争已经打响

2026 年 8 月,AI coding 自主交付(Copilot Autopilot GA,PR 周期 -40%)、开源 Agent 成公用设施(Qwen3.8 Max 登顶 BenchLM 79.91)、具身智能真实落地(世界机器人大会 + 人形机器人运动会,中国出货占全球 97%)。竞争焦点正从「谁的模型更聪明」转向「谁的闭环更完整」。

Agent 拿到了钱包和写权限:2026 下半年的真战场是「授权」
原创 人工智能 · 工程实践 · 阅读

Agent 拿到了钱包和写权限:2026 下半年的真战场是「授权」

AWS AgentCore Payments 转 GA、Cloudflare WriteGuard 私测、人形机器人全自主竞技——本周 AI Agent 同时拿到经济自治与写权限,爆炸半径三变量被同时推高。确定性围栏定律、授权阶梯框架与独立分析。

Agent 的胜负手,已经不在模型里
原创 人工智能 · 工程实践 · 阅读

Agent 的胜负手,已经不在模型里

72 小时内 5 条新闻、3 个战场,2026 的工程共识:Agent = Model + Harness。从 Slack Code、Qwen-UI-Agent、Pelican-Unify 到腾讯降本 50%-65%,看 Harness 怎么成了 AI 真正的胜负手。

拆开 Codex Harness:模型之外,Agent 如何把活干完
原创 人工智能 · 工程实践 · 阅读

拆开 Codex Harness:模型之外,Agent 如何把活干完

从 Codex CLI 的 run_turn、上下文管理、工具路由、审批沙箱和压缩源码出发,解释 Codex Harness 与 Codex 的关系,并与 DeepSeek Harness 的插件化运行时逐层比较。

手机上的开源 Agent:对标 Pi 的 6 个原生 App 实战
原创 人工智能 · 工程实践 · 阅读

手机上的开源 Agent:对标 Pi 的 6 个原生 App 实战

对标 Pi 装完即跑、不要 Termux——把这条硬约束丢进 2026 年移动端 Agent 生态,能跑出来的项目只有 6 个。Aether / OpenDroid / PokeClaw / Operit / Gotcha / OpenMinis 真实 GitHub 数据横评 + 工程师选型建议。

Operit 深度拆解:手机里的开源 AI 操作系统
原创 人工智能 · 工程实践 · 阅读

Operit 深度拆解:手机里的开源 AI 操作系统

GitHub 7,140★ 的 Operit 是当前移动端原生 AI Agent 中功能最稠密、迭代最稳的开源项目。本文做一次全维度深拆:架构、技术栈、历史、热度、活跃度、质量、先进性、功能、用法、桌面版、性能,以及 9 个我未想到的判断。

Cerebras CS-4:号称推理比 GPU 快 30 倍的「最快 AI 加速器」
原创 人工智能 · 工程实践 · 阅读

Cerebras CS-4:号称推理比 GPU 快 30 倍的「最快 AI 加速器」

Cerebras CS-4 用三颗 WSE-3 Turbo 晶圆级芯片挑战 GPU 推理霸权:30 倍单用户 token 速度、10 倍能效、2 微秒晶圆互联。但「最快」是真实突破还是营销口径?我们拆解数字背后的架构与约束。