Cerebras CS-4:号称推理比 GPU 快 30 倍的「最快 AI 加速器」
Cerebras CS-4 用三颗 WSE-3 Turbo 晶圆级芯片挑战 GPU 推理霸权:30 倍单用户 token 速度、10 倍能效、2 微秒晶圆互联。但「最快」是真实突破还是营销口径?我们拆解数字背后的架构与约束。
共 100 篇文章
Cerebras CS-4 用三颗 WSE-3 Turbo 晶圆级芯片挑战 GPU 推理霸权:30 倍单用户 token 速度、10 倍能效、2 微秒晶圆互联。但「最快」是真实突破还是营销口径?我们拆解数字背后的架构与约束。
智谱 GLM-5.3 在 Artificial Analysis 独立评测中拿到 60 分、并列开源模型第一,定价却仍是中端水平。但 '非常啰嗦' 的评测备注暴露了隐性成本——这篇文章拆解智能、价格、verbosity 之间的真实关系。
从零上手 Google Colab:免费 T4 GPU/TPU 怎么用、持久化存储、复用他人代码、训练模型并把结果下载部署,以及能做哪些在线应用,附 2026 年其他免费 GPU 平台对比。
Turbovec 用 Rust + Google TurboQuant 把 1000 万文档的向量索引从 31GB 压到 4GB,搜索比 FAISS 快 3.4 倍。它击中了 RAG 的内存痛点,但 star 数不等于生产就绪——这篇文章拆解技术原理与落地前的检查清单。
Wiz 自主 AI 安全代理 Red Agent 在 Snowflake 仓库里发现并利用了一个由 GitHub Copilot Autofix 合入的 GitHub Actions 注入漏洞,全程无人工干预拿下内部 Jira——AI 引入漏洞、AI 审查放行、AI 代理自主利用的闭环。
避开格式化器、Linter、主题等成熟红海,看看 MCP 工具、AI Diff 审查与扩展安全审计等 9 个 VS Code 插件方向。
把 Codex 的超长上下文配置、自动压缩和适用边界拆开说明:100 万 Token 能解决什么,又会带来哪些成本与判断问题。
DeepSeek Harness 为什么能把模型、工具、会话和界面做成可组合的插件?从 Cordis 的 Context、inject、事件与可逆副作用,拆开这层 Agent 运行时底座。
DeepSeek Harness 的开源热度背后,值得关注的不是一串 Star,而是 Agent 运行时会不会成为模型、工具和开发者之间新的长期入口。
从 Cactus Compute 的 Needle 2 说起:4500 万参数、14MB 单文件、28MB 内存,跑在 ESP32 上的开源语言模型。梳理超小设备跑 AI 的现状、同类玩家、发展趋势,以及它对“小”的重新定义和给开发者的建议。
DeepSeek 把 Harness 以 dsh 开源。本文从源码拆开 Cordis 插件树、事件溯源会话、工具执行流水线、上下文压缩、沙箱与子 Agent,判断它究竟是一款编程助手,还是一个可替换的 Agent Runtime。
核对 DeepSeek V4 Pro 正式版的 1M 上下文、384K 最大输出、API 价格与官方 Codex 配置脚本,并判断已有本机配置在什么情况下需要更新。
MCP 解决了 Agent 怎么调用工具,ARD 解决的是更早一环:Agent 怎么找到工具。2026 年 6 月 Google 联合微软、GitHub 等发布 ARD 规范,核心是域名下的 ai-catalog.json 和聚合注册中心。本文拆解 Catalog/Registry 机制、与 MCP/A2A 的分工,以及验证机制背后的供应链安全账。
从 2021 年的“更快 JavaScript 运行时”到 2026 年 Anthropic 收购、成为 Claude Code 的基础设施,再到用 Claude Code 把自己重写成 Rust。这篇讲清 Bun 的基本概念、它要解决的 Node 工具链痛点、1.3 时代的全栈能力,以及收购和重写背后的趋势判断。
Markdown 参考手册:每个语法都配「写法代码 + 渲染结果」对照,覆盖标题、段落与换行、强调、列表、链接、图片、引用、代码块、表格、分割线、转义、脚注、公式等基础与进阶语法,附平台差异、工程实践、lint 校验和一页速查表。
MCP 第 5 版规范把协议从有状态长连接改成无状态核心:握手没了、会话 ID 没了、请求变成自带上下文的自描述 HTTP POST。本文列出每个变更的工程含义、迁移顺序和 Akamai 指出的六类新安全风险,给正在维护 MCP server/client 的人一份可对照的清单。
Meta 在 2026 年 8 月 5 日发布首个终端编程 Agent Muse Code。本文基于官方发布与第三方公开数据整理:模型与价格、两档计费的真实成本差、三大编程基准上的名次、以及真正值得关注的 event log 与后台常驻 Agent 设计。
上一篇用 48 小时真实会话证明了它便宜又耐用,这篇拆到适配层看它为什么能被 Codex 用好:~/.codex/models.json 的每个字段怎么改变客户端行为,1.77 万字符的 instructions_template 怎么把模型变成合格的 Codex 代理,以及 DeepSeek Harness 的内测招募、官方基准和社区猜测。