Liquid AI 发布了 d1,这是其首款同时支持文本和图像输入的决策模型。与标准语言模型不同,d1 通过单次前向传递处理非结构化数据,返回结构化决策的概率,而无需生成 token。
- 在六个现实世界应用中,有四个应用的表现达到或超越了 GPT-6.1 Sol,且成本仅为后者的 1/19 到 1/200。
- 响应速度显著快于竞争对手,文本决策仅需 200 至 300 毫秒。
- 在单个请求中支持 Noul(是/否)、选择和评分问题类型。
- 在未针对特定领域进行专门训练的情况下,在视觉检查任务中表现出高精度。
该模型可通过 Liquid AI API、Vercel 和 OpenRouter 获取,仅按输入 token 计费。