图解 · MCP
让 AI「失忆」,竟是今年最重要的一次升级
月下载 4 亿次的 MCP 被推倒重来。最关键的一刀,是让 AI 别再记住你。
月下载 4 亿次、950+ 服务器、Figma 和 Zoom 集体发贺电——Anthropic 这次把 MCP 推倒重来,最关键的一刀却是:让 AI 别再记住你。
- 4 亿:月度 SDK 下载量,一年增长 4 倍
- 10 亿+:TS / Python SDK 累计各自破十亿
- 950+:Claude 商店里已上架的服务器
当一个协议的下载量到这个量级,它就不再需要说服谁——它变成了默认选项。标准之争,基本结束了。
先搞清楚 MCP 到底是什么?
你可以把 MCP(Model Context Protocol)理解成 AI 世界的插座标准。
大模型本身只会「说话」。它不知道你的日历排了什么、公司数据库里有多少订单、Figma 里那份设计稿长什么样。要让它知道,就得有人写一根「线」把模型和软件接起来。
问题在于:如果每个 AI 产品都要和每个软件单独接一次,那就是 N × M 根线,谁都做不完。MCP 做的事,是规定了这根线的形状——软件方按标准做一个「MCP 服务器」,任何支持 MCP 的 AI 都能插上去用。
以前,每对组合各接一次:3 × 4 = 12 根定制连线,每加一个软件,所有 AI 都要重接一遍。现在,统一插座:3 + 4 = 7 根标准连线,软件只做一次,所有 AI 都能用。
这正是 HTTP 当年对网页做的事:HTTP 让全世界的电脑连成互联网,MCP 想让全世界的软件和数据连成一张能被 AI 调用的网。
核心变化:从「有状态」到「无状态」
这是本次更新最硬的一刀,也是开发者呼声最高的一条。如果你只读一节,读这节。
旧版 MCP 是有状态的(Stateful):AI 客户端要先和服务器「握手」建立会话,服务器记住这个会话(Session),之后所有请求都必须回到同一台机器——因为只有它记得你是谁。
用生活打个比方:旧版像去银行办事——先取号建档,之后每次都得回同一个柜台、找同一位柜员——资料袋在他手上。他一下班,或者队排太长,你就卡住了。新版像点外卖——每一单都写清完整地址和需求,哪个骑手接单都能送到。人手不够?多派几个骑手就行。
关键差别只有一句:旧版的「你是谁」存在服务器里,新版的「你是谁」写在每个请求里。
这带来什么实际好处?
- 成本降下来:过去为守住几 KB 会话,得租 7×24 常驻服务器;现在按调用次数付费。
- 扩展无上限:请求打到哪台都能处理,流量涨十倍只要加机器,架构一行不用改。
- 容错更强:没有「那台特殊的机器」,挂掉一台不会丢会话,下一个请求照常跑。
可部署到 AWS Lambda、Vercel、Cloudflare Workers 等无服务器与边缘计算平台。
那真的需要「记住」东西怎么办?
Anthropic 给了一个挺优雅的答案:别把状态藏在传输层里,把它交给模型。
状态不再藏在传输层,而是变成模型看得见的参数。工具 A 建立连接或查询,返回 Handle 凭据(如 conn_7f3a…),带上它继续操作工具 B。模型全程看得见这个凭据,能主动在不同工具间穿针引线。
好处:逻辑透明、可审计,也更符合大模型本身的工作方式——它是在「推理」,不是在「维持连接」。
三个新能力,从野路子变成官方标准
过去很多高级功能是开发者各自东拼西凑实现的,互不兼容。新规范把「扩展」(Extensions)正式定为一等公民——不用动核心协议就能加能力。首发三个:
MCP Apps:界面长在对话里
终结「来回切标签页」的时代。以前 AI 只能回你一段干巴巴的文字。现在服务器可以在对话界面里、一个安全的沙盒 iframe 中,直接渲染出可交互的界面。
以前:这季度营收如何?→ 再打开 BI 工具核对。现在:对话里直接弹出可点击、可筛选的动态报表。
Tasks:优雅处理「要跑几小时」的重活
分析 100GB 日志、渲染一段 3D 视频——这类活可能要跑几小时。旧协议很难扛住。新的 Tasks 扩展提供了 tasks/get 轮询与 tasks/update 机制。
提交任务立刻返回 task_id,不必傻等,连接可以断开。变更通知统一到单一数据流:旧版散落在多个 HTTP GET 端点,新版用 subscriptions/listen,客户端按通知类型精准订阅。
企业级管理认证 Enterprise Managed Auth (EMA)
管理员授权一次,全员无感接入。企业可以通过微软 Entra、Okta 等已有的身份提供商(IdP)集中控制谁能用哪些 MCP 服务器。员工按现有组织架构自动继承权限,首次登录时自动连上。
以前:每个员工自己去连、自己授权,IT 无法统一管控。现在:零接触安全登录,满足合规审计,用户几乎无感。
两个配套基建,可能比协议本身更值钱
开发者数据看板
你的 MCP 服务器在 Claude 上表现如何?有没有报错?延迟高不高?过去这是个黑盒。现在只要上架 Claude 应用商店,就能看到官方看板:采用率、错误诊断、延迟分布,还能按不同产品界面拆分使用数据。
MCP Tunnels(研究预览版)
这个解决的是一个非常真实的痛点:很多大企业眼馋 AI 的能力,但保密要求让他们绝不可能把内部数据库或 ERP 暴露在公网上。
MCP Tunnels 在防火墙底下挖一条加密隧道:不暴露公网 IP、不配置入站防火墙规则、不设 IP 白名单——金融、医疗、政企这些强监管行业,等的就是这个。
极客加餐:底层协议究竟改了什么
非技术读者可跳过本节。以下是 Anthropic 从 18 个月生产环境经验里做的重构。
MRTR:多往返请求取代长连接
以前服务器要主动问客户端要数据(比如缺参数、需要用户确认),必须维持一条双向长连接。现在改成短回合制:客户端调用工具,服务器返回 resultType: "input_required",客户端带 inputResponses 重新发起,服务器返回最终结果。断开也没关系。
基于请求头的路由 Mcp-Method / Mcp-Name
可流式 HTTP 请求现在必须带 Mcp-Method 和 Mcp-Name 头。网关、限流器、WAF 不用再解析 JSON 主体,直接读信封就能路由和计费。
列表结果全面支持缓存 ttlMs · cacheScope
tools/list、prompts/list 等接口的响应会自带 ttlMs(生存时间)和 cacheScope(缓存作用域)提示,并保证确定性排序。客户端可据此制定缓存策略,减少重复拉取——在按 token 计费的时代,这是实打实省钱。
认证授权的硬化 OAuth 2.0 · OIDC · RFC 9207
官方说过去一年开发者接入 MCP 时最耗时的就是授权认证。这次:① 全面对齐生产级 OAuth 2.0 与 OIDC;② 强制遵循 RFC 9207 发行者验证,堵死授权服务器混淆漏洞;③ 弃用 DCR(动态客户端注册),转向 CIMD(客户端元数据文档)——被 OAuth 拒绝 localhost 重定向折磨过的 CLI 开发者,可以松口气了。
巨头激动的点,其实各不相同
协议能否成为「行业标准」,一半看技术,一半看商业生态买不买账。这次不是闭门造车,而是与生态伙伴历经数月打磨验证的产物。有意思的是,每家在乎的恰好是这次更新的不同部分:
- Figma:需要 AI 顺畅接入其庞大的设计资产库——MCP Apps · 扩展体系
- Intuit:做金融业务,要的是绝对可靠的安全认证——EMA · OAuth 硬化
- Netlify:骨子里就是 Serverless,只认无状态——无状态架构
- Zoom:通信产品,对延迟极其敏感——Header 路由 · 缓存
这种来自头部生态的背书说明一件事:MCP 已经跨过「极客玩具」阶段,进入企业级部署的深水区。
「新版本是自一年多前远程 MCP 首次发布以来最重要的更新。它在服务可扩展的 MCP 服务器方面实现了飞跃,为 MCP 的未来奠定了坚实基础。」—— Anthropic 官方博客
迁移不用慌,你有 12 个月
2026-07-28 新规范发布,+12 个月旧机制停止工作。过渡期内:Roots / Sampling / HTTP+SSE 照常可用。
四大 Tier 1 SDK(TypeScript、Python、Go、C#)已全面支持 2026-07-28 规范,Rust SDK 在 Beta 中提供支持。
- 去 MCP 官方博客拉完整规范和更新日志
- 更新到最新版 SDK
- 把现有 MCP 服务器改造成无状态,试试一键部署到 Serverless
如果只记三件事
- 无状态是核心。协议不再替你记住会话,每个请求自带全部信息——这让 MCP 服务器第一次能像普通网站一样随便扩容、随便省钱。
- 能力从野路子变成标准。MCP Apps(界面长在对话里)、Tasks(长耗时任务)、EMA(企业统一认证),三个过去各家自己拼凑的东西,现在有了官方规范。
- 这是分水岭,不是版本号。4 亿月下载 + 巨头集体背书 + 企业级安全和内网隧道,标志着 AI 智能体正从「个人玩具」走向「企业基础设施」。
编译整理自新智元报道《Claude 最大规模 MCP 升级,月下载狂飙破 4 亿》。技术细节与数据均来自原文,未经独立核实,建议以 Anthropic 官方博客与 MCP 规范文档为准。