AI AI工具情报站
AI资讯ai-models

Liquid AI 发布 d1 决策模型并新增图像输入能力

Liquid AI 模型与工程博客(网页)2026-10-05T00:00:00.000Z

核心亮点

Liquid AI 放出 d1,定位为决策模型——不是又一个只会聊天的语言模型,而是把感知、推理和行动建议揉进同一个闭环。这一版最大的增量,是终于接上了文本之外的图像输入。

具体能力与事件经过

此前 Liquid AI 的系列模型主打液态神经网络与高效推理,d1 把重心放到决策上:给它一段情境,它不只描述,还能给出可执行的下一步。新版本加入图像输入后,模型可以同时读文字指令和看图片或截图,在看一眼界面再决定点哪这类任务上更顺手。

体验入口已经开放:通过 console.liquid.ai 和 d1 Playground,开发者可以直接试用,无需等待排期。

技术细节

决策模型和常规大模型的区别,在于输出目标。聊天模型优化的是下一个词像不像人话,决策模型优化的是这一步动作对不对。d1 在训练上更强调基于状态的价值判断——类似强化学习里的值函数思路,但封装成对开发者友好的调用接口。图像输入的加入,意味着多模态状态可以被直接喂进决策回路,而不必先转成文字描述。

与竞品对比

和 Google Gemini、OpenAI 的多模态模型比,d1 不拼知识广度,而是拼行动密度。它更像是一个轻量的 Agent 大脑,适合嵌进需要实时反应的产品里,而不是拿来写长文。和同类 Agent 框架比,它的差异是模型原生带决策能力,而非靠外部编排脚本硬凑。

行业影响与适用场景

对开发者:做 GUI 自动化、游戏 AI、机器人调度这类看状态做决定的场景,d1 比通用大模型更贴身。对企业:把决策模型接进业务流程,能在客服分流、异常处置上减少人工规则。对用户:未来你看到的智能体背后,可能会有越来越多这类专精决策的小模型,而不是一个万能大模型包打天下。