跳到正文
北京时间

智谱 GLM

智谱的 GLM 系列模型动态:旗舰开源发布、代码与推理能力迭代、商业化与生态进展的追踪。

最新精选

第 21–32 条 · 共 32 条
6月13日周六
  1. 公众号:智谱(GLM)70

    GLM-5.2 全量开放:智谱最强开源模型支持 1M 上下文

    智谱发布迄今能力最强的开源模型 GLM-5.2,支持真正可用的 1M 上下文,并在长程任务中继续保持领先,同时也是其最强的国产 Coding 模型。今晚 5:21,GLM-5.2 将面向 GLM Coding Plan 全量用户开放,覆盖 Lite / Pro / Max / 团队版。GLM-5.2 API 将于下周上线,模型下周正式开源,遵循 MIT 协议。

    推荐理由:GLM-5.2 的 MIT 开源意味着企业可无授权顾虑地基此构建编码工具,若长程能力兑现,可能重塑国产代码助手的成本边界。

6月2日周二
  1. IT之家(RSS)75

    智谱:建议 A 股发行并在科创板上市

    智谱计划向中国监管机构申请发行A股并在科创板上市。发行股份数量占发行完成后总股本的2%至8%,预计全部为新股,原股东不发售。本次发行募集资金净额将投资于人工智能通用基座大模型、大模型MaaS一站式服务平台及补充流动资金。此外,公司拟将英文名称由“Knowledge Atlas Technology Joint Stock Company Limited”变更为“Z.AI Co., Ltd.”。

    推荐理由:智谱冲刺科创板,这可能是国内大模型公司上市第一枪,募资砸向基座大模型,如果成功,对行业融资是个强心针,但还在建议阶段,先标记。

5月22日周五
  1. IT之家(RSS)73

    智谱GLM-5.1高速版发布:刷新全球大模型API速度纪录

    5月22日,智谱向部分企业客户推出了旗舰大模型GLM-5.1的高速版API“GLM-5.1-highspeed”。该版本输出速度达400 tokens/s,刷新了全球大模型API速度上限。关键突破在于,它首次在国产大模型中实现了旗舰级能力与低延迟的结合,打破了“高速模型即轻量模型”的传统。该版本由智谱GLM团队与TileRT团队合作,通过系统级优化确保了速度的生产级稳定性,适用于AI编程、实时语音交互等场景。

    推荐理由:智谱把旗舰模型拉到 400 tokens/s,还保持全尺寸能力,不是那种为快阉割的小模型。做实时交互、AI 编程的可以认真看看,延迟敏感场景的选型参数要重写了。

  2. 公众号:智谱(GLM)64

    GLM-5.1高速版发布:400 tokens/s,旗舰级能力跑出全球最快API速度

    智谱面向部分企业客户推出GLM-5.1高速版API“GLM-5.1-highspeed”,输出速度达400 tokens/s,刷新全球大模型厂商API速度上限。该版本首次在国产大模型中实现旗舰级能力与极致低延迟并存,由GLM团队与TileRT团队联合打造,通过AOT静态编排、Tile级微任务及8卡NVL拓扑特化等系统级优化,确保400 TPS为稳定可用的生产级能力。

    推荐理由:在旗舰模型上实现400 tokens/s,打破了高速必为轻量模型的惯例,对编码智能体等实时交互场景提供了不牺牲能力的低延迟方案。

  3. 公众号:智谱(GLM)63

    智谱推出GLM-5.1高速版

    智谱发布GLM-5.1高速版,推理速度达400 tokens/s,在顶尖模型中生成速度最快。

    推荐理由:智谱把GLM-5.1做到了400 tokens/s,虽然发布已半个月,但这是国产模型在推理速度上的新标杆,做实时应用的可以看看。

5月21日周四
  1. 公众号:智谱(GLM)76

    智谱联合驭驯网络与清华提出ZCube组网架构,破解大模型推理网络瓶颈

    智谱、驭驯网络与清华大学联合提出并落地ZCube组网架构,以扁平化拓扑替代传统Clos/ROFT架构,从结构层面消除PD分离推理中的可避免拥塞。在GLM-5.1 coding生产环境千卡集群实测中,ZCube相比ROFT将GPU平均推理吞吐提升15%以上,TTFT P99降低40.6%,同时减少约三分之一的交换机与光模块成本。

    推荐理由:架构创新不只是省钱,ZCube 在 GLM-5.1 集群里用三分之一交换机成本换来 15% 吞吐提升和 40% 尾时延改善,为 PD 分离推理提供了一条可复用的组网路径。

5月12日周二
  1. 公众号:智谱(GLM)63

    GLM-5.1获AA全新Coding Agent基准开源第一

    全球权威评测机构Artificial Analysis发布全新Coding Agent Index,包含SWE-Bench-Pro-Hard-AA、Terminal-Bench v2和SWE-Atlas-QnA三项基准,用于衡量模型与Agent harness组合的真实编程能力。闭源模型Opus 4.7(在Cursor CLI中运行)全球第一,智谱GLM-5.1(在Claude Code中运行)获开源第一,代表国产大模型在实际编程Agent场景达到SOTA水平。

    推荐理由:GLM-5.1 在 AA 的新 Coding Agent 基准上拿了开源第一,时隔一个月回头看,这个成绩对国产开源模型在编程 Agent 赛道的位置是个重要注脚,做工具链选型的还是值得扫一眼。

5月8日周五
  1. Z.ai73

    GLM-5V-Turbo 技术报告:迈向原生多模态智能体基础模型 本报告总结了GLM-5V-Turbo在模型设计、多模态训练、强化学习、工具链扩展以及与智能体框架集成等方面的主要改进。这些进展使其在多模态编码、视觉工具使用和基于框架的智能体任务中表现出色。 http://arxiv.org/abs/2604.26752

    推荐理由:智谱把多模态、RL和Agent工具链捆成一体,这篇报告对做多模态Agent的人有直接参考价值,不只刷榜还有工程细节。

4月17日周五
  1. 公众号:智谱(GLM)64

    AutoClaw上线自进化机制与Skill商店,GLM Office Skills五件套同步上架

    AutoClaw(澳龙)正式上线自进化机制与Skill商店,每轮对话后扫描用户纠正、新教方法或踩坑经验,经用户审批后写入永久记忆,支持关键词触发和自动检测两种方式,并保持每周1-3次高质量进化。

    推荐理由:自进化把偏好校准转为永久记忆,Office Skills则让一次指令同时生成PPT、讲稿和图表,对需要频繁产出标准化材料的团队有直接提效。

4月8日周三
  1. 公众号:智谱(GLM)62

    GLM-5.1开源:一个独立工作8小时的模型

    智谱推出开源模型GLM-5.1,支持独立工作长达8小时。模型可直接部署使用,无需人工频繁干预,适用于长周期自动化任务场景。

    推荐理由:智谱把 GLM-5.1 开源,并且主打 8 小时独立工作,这个定位切中了 agent 场景下长任务执行的痛点,想做自动化流程的可以跑起来试试。

2月11日周三
  1. Modal 官方工程博客(RSS)71

    Modal 上线 Z.ai GLM-5 免费端点并提供自部署代码

    Z.ai 发布开源权重模型 GLM-5(MIT 许可,面向长程 Agent 和系统工程),Modal 与其合作上线免费体验端点,4 月底前可用,限单并发请求。FP8 精度下模型约 700 GB,需多 GPU 部署,Modal 用 8 张 B200 单节点配合 SGLang 运行,内部实测每用户 30-75 tokens/秒。

    推荐理由:Modal 官方给出 GLM-5 的部署细节、免费端点限制和前端接入配置,读者可直接照做在自己常用的 Agent 框架里试用。

7月31日周四
  1. LMSYS:Blog(Chatbot Arena 团队)

    智谱发布 GLM-4.5 系列模型并原生支持 SGLang

    智谱发布旗舰模型 GLM-4.5(355B/32B 激活)与 GLM-4.5-Air(106B/12B 激活),含 FP8 量化版本,即日起原生支持 SGLang 框架。采用 MoE 架构与 128k 上下文,在 12 项基准测试中分列第 3 与第 6。GLM-4.5 在 BrowseComp 网页浏览任务中以 26.4% 准确率超越 Claude 4 Opus,工具调用成功率达 90.6%,编程与数学推理能力突出。

    推荐理由:国产大模型Agent与编码能力跻身第一梯队,为开发者提供Claude/GPT之外的高性价比替代方案