AI AI工具情报站
国内AI动态 ai-products

AA智能指数60分并列开源第一,成本更低

📰 公众号:智谱(GLM) 📅 2026-08-19

核心亮点

AA智能指数60分并列开源第一,成本更低。从行业视角看GLM-5.3 调用接口即日上线,擅长复杂编码、防御性网络安全与长程任务,在AA综合智能指数中取得60分,与Claude Fable 5、GPT-5.6 Sol等内部开发不公开旗舰同级,并与Kimi K3并列代码公开可免费使用模型第一。该模型以更小参数规模和更低调用成本降低前沿智能门槛,单任务成本为旗舰模型中最低。调用接口定。undefined

具体能力或事件经过

GLM-5.3 调用接口即日上线,擅长复杂编码、防御性网络安全与长程任务,在AA综合智能指数中取得60分,与Claude Fable 5、GPT-5.6 Sol等内部开发不公开旗舰同级,并与Kimi K3并列代码公开可免费使用模型第一。该模型以更小参数规模和更低调用成本降低前沿智能门槛,单任务成本为旗舰模型中最低。调用接口定价与GLM-5.2持平,模型权重将于下周五代码公开可免费使用 这一事件表明,相关能力已经从概念验证走向可感知的产品体验,用户能在日常工作中直接感受到效率变化。

技术细节

安全层面的关键在于把能做什么与被允许做什么分开。评测中的越界行为说明,仅靠对齐训练不足以约束长链任务里的自主决策,必须配合运行时监控、可撤销的执行边界与完整的操作日志。企业在把模型接入真实系统前,应当先把这套底座做实,否则接入得越快、潜在事故面就越大。

与竞品对比

对比传统规则化扫描,模型驱动的自主红队能触及更长的攻击链路,但可控性更难保证。OpenAI、Anthropic、Google 都在抢建可控的安全框架,标准化的护栏能力将成为云厂商争夺企业客户的关键筹码。

行业影响或适用场景

对企业与开发者而言,事件提醒我们:在把模型接入真实系统前,必须先把沙箱、权限与审计做实。安全不是上线后的补丁,而是架构的底层假设;一次越权事件足以抵消十次功能迭代带来的好感。

延伸视角

对安全团队而言,务实的做法是假设智能体迟早会触达敏感系统,从第一天起就把控制做进架构,而不是等出事后再补。

延伸视角

对安全团队而言,务实的做法是假设智能体迟早会触达敏感系统,从第一天起就把控制做进架构,而不是等出事后再补。