MCP 2026-07-28 规范更新,媒体普遍报道为「取消协议会话,可扩展性大提升」——这没错,但同一版本里还有一个被低估的改动:新增两个必需的 HTTP 标头 Mcp-Method 和 Mcp-Name,让网关不用解析请求体,就能对 Agent 流量做路由、限流和计量。Hacker News 上的争论同样值得看:分歧不在「无状态是不是进步」,而在「这个进步说明了什么」。
旧协议为什么难扩展
早期传输以 initialize/initialized 握手建立会话,用 Mcp-Session-Id 标头跟踪,之后每个请求都要找到对应会话的状态:自动扩缩要保留会话、部署要排空或迁移会话、负载均衡基本做不了——客户端被钉在持有会话的那台实例上。
新协议把握手、会话标头和协议会话从核心请求路径里拿掉了。每个请求自带协议版本、客户端身份和能力,可以落到任意实例。
真正的变化:元数据下沉到传输层
MCP 消息本质是 HTTP 上的 JSON-RPC,以前所有请求信息都在 JSON 正文里,网关必须解析正文才知道是列工具、调工具还是读资源。现在 Streamable HTTP 请求必须带两个标头:Mcp-Method 和 Mcp-Name。工具调用形如 Mcp-Method: tools/call、Mcp-Name: search。Cloudflare 的 Matt Carey 详细讲过这个好处:网关、限流器、WAF 可以按方法或工具采取措施,用的正是它们处理所有其他 API 的那套机制。规范甚至允许把工具参数复制进标头做自定义路由。
治理正在往下走
此前 Agent 治理走的是另一条路:Cloudflare 的 agent tracing、Azure API Management 的 AI Gateway 层,都作为协议之上的独立控制层。这次发布把元数据放进传输层,基础设施团队已经在跑的系统直接就能读。多 Agent 共享一个代码库时的地盘冲突,最终也要靠这一层治理来解决。
Elicitation 被拆开了:服务器发起请求不再需要保持开放流,改为多轮往返——服务器返回 input_required,客户端收集答案后重试。审批从一条保持连接变成两个请求,部署更简单,但等待人工响应的过程不再位于单次调用内部。
授权也收紧了:动态客户端注册弃用、2027 年夏季后移除;采用 RFC 9207 做颁发者标识;客户端把规范服务器 URI 作为 RFC 8707 resource 发送,令牌只被该受众接受。
争论的本质:MCP 是不是套了壳的 REST?
一派认为有状态 MCP 事后看显然是错的——它让 MCP 变成了又一个 REST API 端点,负载均衡、API 网关、渐进式发布这些现成基础设施直接复用。pjmlp 说这是行业反复在学的教训,Sun RPC 时代就得出过同样结论:无状态服务器永远更好。luciana1u 更直接:「我们发明了一个有状态协议,发现状态难扩展,于是剥掉状态,最终得到——发一个 POST 请求。」REST 阵营等了 20 年。
辩护方不否认相似,但不同意结论。vidarh 概括得最简洁:MCP 的核心优势在于它是 AI 提供商背书的标准,因此人们有强烈动力真正去实现它。MCP 真正发明出来的,是一套模型已经被训练会用的约定。
另一条并行讨论:Agent 到底需不需要协议?直接给 shell 访问普通 CLI 工具不行吗?反驳是:CLI 立场假设使用者是笔记本电脑前开着 shell 的开发者,这只是很小一部分场景——大多数使用来自手机 App、网页聊天和嵌入式组件。
真正的信号:钱流向了哪一层
采用量没有争议:Anthropic 报告 MCP SDK 月下载超 4 亿次,一年翻了三倍。但采用能不能惠及单个服务器是另一回事。一家咨询公司审计客户服务器,三个月 61 次工具调用,58 次来自客户自己的工程师——团队把「智能体能访问」当成了「智能体愿意访问」。帖子结论与这次发布呼应:资金正在流向网关、注册中心和身份验证层,而不是服务器本身。
这才是值得关注的结构变化。Agent 流量成为真实负载后,价值在向控制面集中——路由、计量、认证——而协议本身在向业界跑了二十年的普通 HTTP 工具链收敛。MCP 的贡献从来不是线格式,而是让 Agent 工具访问成为模型和提供商都愿意承诺的标准。
生产环境怎么迁移
依赖协议会话、服务器到客户端请求或流的团队,迁移确实要花功夫。规范和新版 TypeScript、Python、Go、C# SDK 已发布。推荐路径:在现有有状态会话路由旁跑一条无状态路由,把功能迁过去,排空活动会话,在弃用窗口内移除旧路径。同时把 Mcp-Method、Mcp-Name 当作网关和限流器配置里的一等信号——行业正在往这个方向走。如果团队在跑 Agent 基础设施,先审计真实工具调用,别假设「Agent 能访问」就等于「Agent 愿意访问」;我们对 Anthropic 多 Agent 实验的解读显示,对齐后的 Agent 共享代码库时冲突有多快发生。