AI AI工具情报站
国内AI动态 ai-models

编程能力开源第一,并涌现网络安全能力

📰 公众号:智谱(GLM) 📅 2026-08-14

核心亮点

编程能力开源第一,并涌现网络安全能力。从行业视角看智谱发布GLM-5.3,基于与GLM-5.2相同的基座,通过极致的后训练Scaling提升智能上界,编程能力较前代提升50%,在Terminal Bench 3.0等公开基准中取得代码公开可免费使用第一,并接近Claude Fable 5。模型在白盒代码审查等安全任务中表现持平Mythos 5,在CyberGym测试中得分84.5%。模型权重将在两周后代码公开可免费使用,即日起上线ZCode、AutoClaw等工具。它体现了厂商在发布节奏与合规压力之间的微妙平衡。

具体能力或事件经过

智谱发布GLM-5.3,基于与GLM-5.2相同的基座,通过极致的后训练Scaling提升智能上界,编程能力较前代提升50%,在Terminal Bench 3.0等公开基准中取得代码公开可免费使用第一,并接近Claude Fable 5。模型在白盒代码审查等安全任务中表现持平Mythos 5,在CyberGym测试中得分84.5%。模型权重将在两周后代码公开可免费使用,即日起上线ZCode、AutoClaw等工具 这一事件表明,相关能力已经从概念验证走向可感知的产品体验,用户能在日常工作中直接感受到效率变化。

技术细节

值得指出的是,模型蒸馏与数据抓取争议背后是训练数据的权属问题。在缺乏明确授权的情况下使用受版权保护内容,会使下游产品的合规基础变得脆弱,合理使用抗辩需要更强的证据支撑,而不能只依赖笼统的 transformative use 主张,监管与司法都会盯着这一点。

与竞品对比

与传统的规则化安全扫描相比,基于模型的自主渗透与红队测试能发现更长链路的薄弱点,但也带来可控性挑战;OpenAI、Anthropic 与 Google 均在竞相建立可控的 agent 安全框架,谁先把护栏标准化,谁就掌握行业话语权。

行业影响或适用场景

这件事给企业与开发者的提醒很直接:模型接入真实系统前,沙箱、权限与审计必须先行。安全是架构假设而非事后补丁,一次越权就能抹掉十次功能迭代积累的好感与信任。

延伸视角

对安全团队而言,务实的做法是假设智能体迟早会触达敏感系统,从第一天起就把控制做进架构,而不是等出事后再补。

延伸视角

对安全团队而言,务实的做法是假设智能体迟早会触达敏感系统,从第一天起就把控制做进架构,而不是等出事后再补。

延伸视角

对安全团队而言,务实的做法是假设智能体迟早会触达敏感系统,从第一天起就把控制做进架构,而不是等出事后再补。