公司动态

Anthropic 冲 2 万亿 IPO 还在闭源锁死、智谱把 320B 大模型 MIT 协议直接开源:中美 AI 已经分流

📅 2026/8/28 19:26:16
Anthropic 冲 2 万亿 IPO 还在闭源锁死、智谱把 320B 大模型 MIT 协议直接开源:中美 AI 已经分流
Anthropic 冲 2 万亿 IPO 还在闭源锁死、智谱把 320B 大模型 MIT 协议直接开源中美 AI 已经分流2026 年 8 月 26 日中美两家 AI 头部公司做了两件完全相反的事美国那边Anthropic 据多家媒体披露正在冲刺 1.5–2 万亿美元 IPO 估值旗下模型继续维持闭源、API 调用的模式中国这边智谱 Z.ai 把一颗 320B 总参数、原生多模态的大模型 GLM-5.3-Flash320B-A18B以 MIT 许可证完全开源所有权重、推理代码随便下载。如果只看热度这条新闻大概只能算一个普通的开源公告。但把两边数字并排放一起看对比就有点离谱智谱新模型在 Artificial Analysis Intelligence Index 上拿到 57 分直接追平 Anthropic 旗下最受欢迎的 Claude Opus 4.8而它的定价只有 Opus 4.8 的 1/40输入侧每百万 token 的成本低到接近免费它甚至没有用任何一张英伟达显卡整个推理流量全部跑在国产 AI 芯片上。一边是估值奔着 2 万亿美元去、闭源锁死一边是 320B 模型 MIT 协议送出来、定价打到地板、还跑在国产算力上。同一个月里出现这两件事几乎可以给 2026 年的中美 AI 路线画一条清晰的分界线。一、Anthropic 那边在做什么2 万亿 IPO 闭源锁死先把美国这边的背景摆出来方便后面做对比。Anthropic 在 2026 年的关键词是「冲 IPO」。从 7 月底开始多家财经媒体披露公司正在与高盛、摩根士丹利等承销商讨论 IPO 路径市场传闻估值在 1.5 万亿到 2 万亿美元之间最高估值一旦成真将超过 SpaceX 在私募市场创下的纪录成为人类历史上估值最高的非上市科技公司。支撑这个估值的故事是 Anthropic 在企业 API 市场的强势增长。Opus 5 系列自 2026 年 7 月 24 日以每百万输入 token 5 美元、输出 25 美元定价发布以来企业客户渗透率快速攀升同时8 月下旬开发者通过 API 流量监控还发现了两个新的早期测试代号——Marshmallow 和 Melon——意味着迭代节奏可能加速到月更。所有这些增长模式都很一致闭源、API、付费调用。开发者要用 Claude 的能力要么订阅 ChatGPT 之外的 Claude App要么接入 Anthropic 的 API 走按 token 计费。模型权重本身被严密保护公司估值靠的是「唯一供给方」这个稀缺性。二、智谱这一天做了什么MIT 协议 1/40 价格 国产芯片8 月 26 日北京时间晚间智谱 Z.ai 一次性发布了三件东西第一件GLM-5.3-Flash320B-A18B模型权重MIT 许可证开源。在 Hugging Face 上任何人可以下载所有权重文件包括原始的多模态 vision encoder 和 MoE 路由权重社区可以在商用产品里直接使用不需要申请授权、不需要分成、不需要标注来源MIT 协议本身的宽松度。第二件完整 API 定价每百万输入 token 0.15 美元约合 1 元人民币每百万输出 token 0.6 美元。这是 GLM-5.3 旗舰版定价的 1/10在限时折扣期内更降到 1/20相当于 Anthropic Claude Opus 4.8 API 价格的 1/40。第三件是这次发布最反常识的细节在 OpenCode 和 OpenRouter 两个开放平台进行匿名测试Ox-Alpha期间模型创下双平台调用量历史新高所有这些推理流量都没有走英伟达 GPU而是全部跑在国产 AI 芯片上。这意味着智谱从一开始就把「不依赖英伟达」写进了推理栈的默认路径。三、把数字摊开320B 总参数 / 18B 激活 / 1M 上下文很多人看到「开源大模型」会本能反应开源的肯定弱。这是 2023 年的旧认知但在 2026 年已经站不住脚。GLM-5.3-Flash 的几个关键数字值得一个一个拆开看。维度GLM-5.3-Flash 规格行业对比含义总参数规模320B3200 亿参数与 DeepSeek V3 同量级超过 Llama 3.1 405B单 token 激活参数18B激活 MoE总参数的 5.6%推理算力成本接近 18B 稠密模型上下文长度1,000,000 token1M等于约 150 万中文字符可塞进整本《活着》多模态原生 vision text文本和图片在同一颗模型里联合训练不是后接视觉 encoder训练许可证MIT License商用免费、无须注明来源、可二次分发需要重点解释的是「18B 激活」这件事。320B 总参数是 MoEMixture of Experts架构下的所有专家网络加起来的容量但推理时每个 token 只会被路由到其中一小撮专家上实际算力消耗相当于 180 亿参数的稠密模型。这是为什么一颗 320B 的模型能在国产 AI 芯片上跑、且单次推理成本可以做到 0.15 美元——并不是模型变小了而是「按需调用」把成本结构改了。Artificial Analysis Intelligence Index 是目前业内公认最综合的模型能力评测覆盖推理、代码、数学、多模态理解、长上下文、工具使用等多个维度。GLM-5.3-Flash 在这个指数上拿到 57 分进入「全球前沿模型能力区间」与 Anthropic Claude Opus 4.8 得分完全持平。在自研的 Z.ai Code Bench 体感评估中它的编程能力也和 Opus 4.8 相当。换句话说在「前沿模型」这个赛道上开源阵营第一次有了一个能力上不输于顶级闭源旗舰的选手。四、1/40 价格是怎么算出来的价格对比是这次发布最有冲击力的一张牌。智谱官方给的数据是GLM-5.3-Flash 的输入定价是 Opus 4.8 的 1/40输出定价更夸张地低。要理解这个倍数关系要看三个数模型输入价格每百万 token输出价格每百万 tokenClaude Opus 4.8Anthropic5 美元25 美元GLM-5.3 旗舰版智谱1.5 美元6 美元GLM-5.3-Flash智谱0.15 美元0.6 美元GLM-5.3-Flash 限时折扣0.075 美元0.3 美元纵向看Flash 版是 GLM-5.3 旗舰版的 1/10限时折扣期内是 1/20。横向看Flash 版对比 Opus 4.8 是 1/40。这个价差不是简单的「补贴换市场」。MoE 架构 国产芯片 量化推理优化三件事叠加之后单位算力的边际成本结构本身就和英伟达生态不同。智谱不需要支付高昂的 HBM 内存溢价GLM-5.3-Flash 实际推理时占用更少显存也不需要负担数据中心 CapEx 的高折旧所以可以把价格压到这种程度。对开发者的实际意义是之前在 Anthropic API 上跑一次完整的企业级 RAG 任务可能要花 5 美元换到 GLM-5.3-Flash 同样任务大约 0.15 美元。中小团队和个人开发者第一次有机会把「前沿大模型」当成水电煤一样按需使用不需要任何预算审批。五、为什么是 MIT 而不是 Apache 2.0 或 GPL开源许可证的选择本身就是一个商业信号。MIT License 是开源世界里最宽松的许可证之一核心条款只有三条保留版权声明、保留许可声明、不得用原作者名义为衍生作品背书。除此之外使用者可以随便商用、修改、闭源、转售不需要公开自己的修改。对比来看- Apache 2.0基本与 MIT 类似但额外要求标注修改记录、对专利授权更友好- GPL 类许可证要求衍生作品必须同样开源强传染性- Llama 社区许可证保留 Meta 的特殊条款限制月活超 7 亿的公司使用智谱选 MIT 而非其他是一个非常清晰的商业策略尽可能降低全球开发者的使用门槛包括那些月活过亿的大厂、海外企业客户、上市公司。在 MIT 条款下任何公司都可以合法地把 GLM-5.3-Flash 内嵌进自己的产品不需要担心律师函或合规审计。这是和 Anthropic 路线最本质的差异Anthropic 把模型能力封装成 API 服务靠稀缺性定价智谱把模型能力封装成可下载权重靠规模效应摊薄成本。两种模式都成立但玩家心态不同。六、国产 AI 芯片为什么能扛住这个流量「全部跑在国产 AI 芯片上」这件事比开源本身更有产业意义。在 GLM-5.3-Flash 的匿名测试阶段Ox-AlphaOpenCode 和 OpenRouter 两个平台的调用量创下当周历史新高意味着大量真实用户在不知情的情况下已经在使用国产算力。智谱官方并没有公开具体的芯片供应商但行业普遍推测是华为昇腾、寒武纪、海光信息等国产 AI 加速卡中的一家或几家联合。这件事的战略含义有两层第一层是供应链安全。当一个 320B 级别的旗舰模型可以在没有英伟达 GPU 的环境里跑完整推理那对一家中国 AI 公司来说未来即使面临出口管制升级也不会出现「模型不能部署」的硬卡点。第二层是定价权。前面提到的 1/40 价格优势其底层支撑正是国产芯片的 TCO总拥有成本更低。英伟达 H100/B200 单卡价格 2.5 万—4 万美元加上 HBM 高带宽内存和高功耗整套推理机柜的折旧成本非常高国产 AI 芯片在能效比上正在快速追近且供应稳定、采购周期短。七、这条路线的真实代价开源不是慈善把上面所有对比都摆出来之后必须正视一个问题开源不是慈善。如果智谱不是为了商业回报为什么要这么做答案藏在三件事里第一模型本身已经不是稀缺品。2026 年的前沿大模型能力越来越同质化GPT-5.6、Claude Opus 4.8、Gemini-3-Pro、GLM-5.3 在 AA Index 上的差距已经收敛到个位数分。在这个阶段「唯一能提供前沿模型」的稀缺性正在消失闭源溢价的天花板会被持续压低。智谱提前放弃闭源溢价换的是更大的生态卡位。第二开源是用户入口。MIT 协议下的权重下载意味着全球开发者会自发地在 Hugging Face、ModelScope、Civitai 等平台上做微调、做评测、做二次开发每多一个衍生项目都是智谱生态的一根天线。这些天线汇聚的真实调用量最终都会回流到智谱自己的 API 服务和云平台——这才是商业闭环。第三中国 AI 需要一条独立的路径。在英伟达生态下中国 AI 公司本质上是「客户」在开源 国产芯片的组合下中国 AI 公司可以是「供给方」。角色不同估值逻辑、议价能力、地缘风险敞口都不同。智谱这一步棋是在替整个中国 AI 行业抢一个身位。八、给从业者的实际建议中美 AI 路线分流这件事对中国开发者、企业 IT 决策者、AI 创业者各有不同的实操含义。角色短期行动1–3 个月中期观察3–12 个月个人开发者用 GLM-5.3-Flash 替换部分 GPT/Claude 调用场景控制 API 成本把模型权重下载到本地测试微调关注社区微调项目LoRA、QLoRA的成熟度中小企业 CTO评估把内部知识库、客服系统、RAG 应用切换到 Flash 版的 ROI对国产芯片推理集群做 POC 测试关注国产芯片产能爬坡和价格走势大厂 AI 平台负责人在不敏感的内部场景如代码补全、日志分析试点 Flash 版建立 OpenAI/Anthropic 之外的多供应商架构评估 MIT 协议下自建模型微调团队的成本与收益投资人重新审视「中国大模型公司估值锚点」——从「对标 OpenAI 的折价」转为「独立生态溢价」跟踪国产 AI 芯片公司的资本开支节奏最关键的一条建议是不要把这次开源当成一个孤立事件。Anthropic 闭源冲刺 IPO、智谱 MIT 开源、DeepSeek R 系列持续更新、阿里 Qwen3.5 / 通义千问家族同步开源——这四条线索合起来看是 2026 年中美 AI 在路线、定价、生态、硬件四个维度上同时分流的缩影。九、写在最后把这次事件压缩到一句话就是当 Anthropic 用 2 万亿美元估值告诉市场「前沿模型可以继续稀缺定价」时智谱用 320B 总参数 MIT 协议 1/40 价格 国产芯片同时回答稀缺不再是唯一解规模化、生态化、芯片自主化是另一条路。两条路没有绝对的对错。闭源路线在短期内依然能维持高利润率开源路线在中长期会积累更厚的生态壁垒。但对 2026 年的中国 AI 来说开源 国产算力这条路的战略价值远超过它本身能带来的账面收入。Anthropic 还在冲刺 IPO智谱已经把 320B 大模型白送了出去。一个月里出现的这两件事比任何发布会都更清楚地标出了中美 AI 的下一阶段走向。