首页
学习
活动
专区
圈层
工具
发布
社区首页 >专栏 >让智谱盘中一度涨近48%的新模型 GLM-5.2 或许你应该试试看

让智谱盘中一度涨近48%的新模型 GLM-5.2 或许你应该试试看

作者头像
做棵大树
发布2026-06-25 09:34:38
发布2026-06-25 09:34:38
5300
举报
文章被收录于专栏:代码日志代码日志
让智谱盘中一度涨近48%的新模型 GLM-5.2 或许你应该试试看
让智谱盘中一度涨近48%的新模型 GLM-5.2 或许你应该试试看

我是大树,一个差点开始放弃折腾的AGI学习与实践者。 最近在探索和从事的事儿:

  • OPC探索、企业的AI自动化转型咨询
  • 重新拾起自媒体平台,继续倒逼自己动脑和记录日常的所思所感不止技术

欢迎大家关注微信公众号 做棵大树,有想要长期联系的朋友也可以通过公众号菜单栏找到我~

上周五,6月13日晚上5点21分,智谱做了两件事。

同一天,Anthropic被迫把自家最强的Fable 5和Mythos 5从全球下架。

然后6月15日港股开盘,智谱盘中一度涨近48%。

你品品这个时间线——美国政府亲手把最大的PR机会,送给了中国开源模型。

这一周到底发生了什么

我先帮你把时间线捋清楚,因为这事的信息密度确实有点高:

时间

事件

6月9日

Anthropic发布Fable 5 + Mythos 5,号称超越所有公开模型

6月12日

美国政府以"国家安全"为由,要求禁止外国人访问

6月13日

Anthropic被迫全球下架Fable 5和Mythos 5

6月13日同日

智谱发布GLM-5.2,宣布MIT开源,面向Coding Plan全量用户开放

6月15日

智谱港股盘中涨近48%,收涨超30%

写到这儿我自己都觉得魔幻。

Fable 5发布的时候,整个AI圈都在讨论"这可能是目前最强的模型"。结果3天后,美国政府一道禁令,直接把它从全球市场上抹掉了。

智谱选在同一天发布GLM-5.2——不是巧合,是精准卡位。

智谱的官方声明原话是这么说的:

“在一些前沿模型突然变得不可用的时刻,智谱选择相信另一条路:前沿智能不应只属于少数人,也不应被少数规则随时收回。

这话说的是谁,懂的人都懂。

GLM-5.2 到底强在哪

好,故事讲完了,聊聊干货。

GLM-5.2的核心卖点,用一句话概括:真正可用的1M上下文窗口 + MIT开源。

先说"真正可用"这四个字。

2026年以来,“百万上下文"快成国产大模型的标配口头禅了。但实际用起来,很多模型的"1M"在40-50万token以后就开始丢信息、幻觉激增。智谱这次特别强调了"真正可用”——意思是1M token范围内的推理质量不崩。

这对编程场景意味着什么?

一个中型项目(5-10万行代码)轻松塞进去,模型可以理解整个项目的架构依赖。不再需要手动切文件给模型看,直接丢整个repo进去让它自己找要改的地方。

技术架构上,社区透露GLM-5的基础是744B参数的MoE模型,每token激活40B参数。新增了High和Max两档思考强度,Max推荐用于复杂多步编码任务。

写到这儿你可能会问:和别的国产编程模型比呢?

维度

GLM-5.2

Kimi K2.7 Code

Qwen 3.7 Max

MiniMax M3

上下文窗口

1M(可用)

256K

128K

1M

开源

MIT(下周)

已开源

仅API

仅API

Agent工具

ZCode 3.0(自研)

兼容Claude Code

无专属Agent

无专属Agent

参数规模

744B MoE

1T MoE

未公布

428B MoE

写这个表格的时候我犹豫了一下,因为参数还没完全公布,很多对比只能基于现有信息。但有一点是确定的:在"开源+自研Agent+MIT协议"这个组合上,GLM-5.2目前是独一份。

ZCode 3.0:自研Agent内核比"更好用"更重要

GLM-5.2发布的同一天,智谱还同步上线了ZCode 3.0。

这个更新的核心不是界面改了什么,而是内核彻底换了

此前的ZCode(以及国内大多数AI编程工具)的做法是:前端自己做,Agent内核套用Claude Code或Cline的开源实现。这有个致命缺陷——第三方Agent内核是为Claude模型优化的,用GLM跑的时候,推理链路、工具调用协议都不对路,效果打折扣。

ZCode 3.0的自研内核解决的就是这个"模型和Agent不匹配"的问题。

更值得关注的信号是:智谱宣布**“后续版本将不再内置或维护其他Agent适配”**。

类比一下:这就像是苹果从"iPhone兼容所有App"转向"iOS+App Store封闭生态"。短期看放弃了灵活性,长期看体验一致性更好。

这意味着智谱不再满足于"GLM模型兼容Claude Code生态"——它要建立自己的GLM+ZCode完整闭环。

对你的实际影响是:如果你已经在用Claude Code,GLM-5.2可以直接通过Anthropic兼容端点替换,不需要改工具。但如果你想要GLM的最优体验,ZCode 3.0可能是更好的选择。

实测怎么样:能打,但有短板

说实话,目前最硬的实测数据来自"数字生命卡兹克"的测评:

  • 10万行代码的监控BUG排查:GLM-5.2耗时21分钟,结果与Claude Opus 4.8一致(Opus fast模式仅需6分钟)
  • 400-500k长上下文:准确性和指令遵循与Claude差距不大
  • LLM Benchmark Code V3私有评测:GLM-5.2(max)综合排名第三,仅次于GPT-5.5(high)和Claude Opus 4.8(high),五个工程场景中获得三个A档评级

但短板也很明确:

  • 纯文本模型,无多模态能力
  • 推理速度偏慢——同任务比Claude慢约2倍
  • 没有高速版 ——Kimi K2.7 Code已经有5-6倍速的高速版了

我的判断是:GLM-5.2在代码工程能力上已经是国产第一梯队,但速度和多模态是接下来需要补的课。

这件事其他的意义

写到这儿,我想聊点超出模型本身的观察。

开源正在从技术选择变成政治选择

Anthropic被强制下架Fable 5的事件,给整个行业敲了一记警钟——当你的核心生产力工具依赖于一家美国公司的API,而美国政府可以随时要求这家公司切断你的访问时,你的业务连续性就攥在别人手里。

智谱的MIT开源协议,本质上是一张安全牌:拿去做什么都行,私有化部署、微调、二次开发后商业化,完全不需要担心哪天API key失效了。

21经济网的报道提到,东方证券认为"Anthropic领先模型的下架,将有利于国产领先模型公司自主创新"。国信证券则指出,智谱GLM系列正沿着"代码能力增强→Agent化→长时任务→自主操作系统"这条路径演进。

国产编程模型进入了"6月淘汰赛"

回顾一下这几个月的时间线:

  • 4月:Kimi K2.6、GLM-5.1、Qwen 3.6三强争霸
  • 5月:Qwen 3.7 Max发布,编程能力大幅提升
  • 6月第一周:Anthropic发布Fable 5,拉开顶级模型和开源模型的差距
  • 6月第二周:Kimi K2.7 Code(6/12)+ GLM-5.2(6/13)接连发布

6月这一轮比的已经不是"谁的基准测试分数更高",而是:谁的模型能真正稳定工作、谁的Agent生态能让开发者"安装即用"、谁的开源协议能让企业放心部署。

下周是关键

GLM-5.2的API定价、开源权重、以及更多第三方基准测试结果,都将在下周(6月16-20日)公布。这三项数据出来之后,国产编程模型的四强格局才会真正明朗。

目前API和开源还没上线,Coding Plan用户已经在ZCode 3.0里用上了,还有150%配额加成。如果你不是Coding Plan用户,等等下周的数据再决定也不迟。

给你的建议

你的场景

推荐选择

原因

追求最强编码能力,不在乎价格

Claude Opus 4.8 / Fable 5

能力断层领先,但贵且可能被限制

用Claude Code,想换国产开源

Kimi K2.7 Code

已开源,兼容主流Agent

想要模型+工具一体化体验

GLM-5.2 + ZCode 3.0

自研Agent深度适配,体验最一致

企业需要私有化部署+商用

GLM-5.2(MIT协议)

最少限制的开源协议

预算敏感,追求性价比

等下周API定价公布

GLM-5.2 vs Kimi的价格对比是关键

我的选择:我目前主力还在用Claude Code + DeepSeek&Mimo,但GLM-5.2的MIT开源+1M上下文确实让我很心动。等我手头的用差不多之后我会搞一个试一下


本文参与 腾讯云自媒体同步曝光计划,分享自微信公众号。
原始发表:2026-06-16,如有侵权请联系 cloudcommunity@tencent.com 删除

本文分享自 做棵大树 微信公众号,前往查看

如有侵权,请联系 cloudcommunity@tencent.com 删除。

本文参与 腾讯云自媒体同步曝光计划  ,欢迎热爱写作的你一起参与!

评论
登录后参与评论
0 条评论
热度
最新
推荐阅读
目录
  • 这一周到底发生了什么
  • GLM-5.2 到底强在哪
  • ZCode 3.0:自研Agent内核比"更好用"更重要
  • 实测怎么样:能打,但有短板
  • 这件事其他的意义
    • 开源正在从技术选择变成政治选择
    • 国产编程模型进入了"6月淘汰赛"
    • 下周是关键
  • 给你的建议
领券
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档