DeepSeek V4 Pro与Grok 4.6同日发布,双双逼近Claude Fable 5体验
核心亮点
8月一个普通的工作日,国内大模型圈被两记重锤同时砸中。DeepSeek 在约两小时的窗口内先后放出 V4 Pro 正式版,而大洋彼岸的 xAI 也几乎同步推送了 Grok 4.6。更引人关注的是,这两款模型在综合体验上都已经逼近被视为编程助手标杆的 Claude Code。换句话说,过去写代码还得用 Claude 的默认选项,正在被悄悄改写。
具体能力或事件经过
据公众号「数字生命卡兹克」的现场记录,DeepSeek V4 Pro 正式版与 Grok 4.6 在极短时间内先后发布,两者体量相当:DeepSeek V4 Pro 约 1.6T 参数,Grok 4.6 约 1.5T 参数。发布节奏本身就很戏剧性——同一天内两个不同阵营、不同地域的团队几乎撞车,被不少从业者解读为头部模型竞争进入白热化的信号。从公开用例看,两家都在强调长上下文、代码生成与多步推理的协同能力,刻意对标 Claude Code 的交互体验。
技术细节
从已披露的信息看,两款模型都把重点放在像人一样持续跟进任务上。DeepSeek V4 Pro 在工具调用与长链路规划上做了增强,Grok 4.6 则延续了 xAI 对实时信息与高强度推理的偏好。两者都试图解决同一个痛点:让模型不只是单次回答问题,而是能在多轮、跨文件、跨工具的真实工程场景里保持一致性。参数量级来到 1.5T 到 1.6T,也意味着训练与推理成本都进入国家级门槛,对中小团队并不友好。
与竞品对比
说白了,这次对比的核心就是 Claude Code。Anthropic 的 Claude 系列长期被视为最会写代码的模型,尤其在 agentic coding 也就是智能体编程场景里几乎成了默认选择。DeepSeek 与 Grok 同时逼近这一体验,意味着闭源标杆的护城河正在变浅。不过也要看到,Claude 在生态、工具链成熟度与稳定性上仍有积累,短期内的体验差距未必能靠一次发布抹平。
行业影响或适用场景
对开发者而言,这一天发布的最大意义是选择变多。一旦 V4 Pro 与 Grok 4.6 在编程体验上达到可用门槛,团队就有了更多议价空间,不再被单一供应商绑定。对企业来说,推理成本与本地化部署能力会成为新的决策点。简单来说,模型战争的焦点正从谁更聪明转向谁更适合我的工作流,而这场同日发布,正是这个转折点最直观的注脚。