我国日均词元调用量突破 500 万亿,中国大模型稳居全球第一梯队
核心亮点
据央视报道,截至 2026 年 6 月,我国日均词元调用量已突破 500 万亿。词元是模型处理文本的基本单位,这个量级意味着 AI 应用正在从尝鲜走向日常生产。简单来说,中国大模型已经稳居全球第一梯队,竞争焦点也从单纯的模型智商,转向智能体落地与生态建设的全面比拼。
具体能力或事件经过
当前全球大模型处在竞争最激烈、迭代最快的阶段。业内人士透露,旗舰模型几乎以月为单位更新。稀宇科技首席架构师冯雯表示,2025 年下半年厂商还希望每 3 个月迭代一次模型,如今每 4 到 6 周就要发布一个新模型。腾讯智慧产业总经理刘峰称,混元 3 正式版上线第一周,其 Token 调用量比上一代混元 2 增长了 68 倍,需求爆发可见一斑。
技术细节
支撑这种爆发的,是模型参数量与上下文窗口的持续扩大,以及训练投入的加码。人工智能正从会聊天走向能干活,智能体开始规模化落地。一次任务往往需要反复检索、读取上下文、调用工具并进行多轮反馈,推理算力需求随之井喷。为锁定算力资源,互联网大厂加速布局 AI 智算中心,并签署长期合作协议。
与竞品对比
相比海外由少数巨头主导的格局,国内呈现厂商密集迭代、应用侧快速渗透的特点。多家长尾场景同时起量,把推理成本与算力消耗推到新高度,也倒逼国产算力与模型架构同步进化。这种从产品验证迈向批量交付的节奏,和海外以单一旗舰通吃的路径明显不同。
行业影响或适用场景
远景科技算力中心总经理郑子浩指出,AI 智算中心建设呈井喷式发展,得益于用户长期稳定的订单承诺。国内算力需求高涨,多地加速布局国产词元工厂与智算综合体,推动国产算力产业链从产品验证迈向批量交付。对开发者和企业而言,这意味着更低门槛、更可控的 AI 能力供给,也意味着推理成本有望随规模效应继续下行。
对开发者的实际意义
落到具体的人身上,词元量级的放大意味着 API 供给更充足、单价更便宜。过去一年,国内主流大模型的价格战已把每百万词元成本压到近乎免费区间,这反过来又刺激了更多长上下文、多轮智能体的调用。对中小团队来说,过去要自建算力才能跑的应用,现在用公开 API 就能低成本落地。说白了,模型能力正在变成像水电一样的基础设施,谁先用起来、用得巧,谁就拿到效率红利。