Architect Financial Technologies 推出 LLM 推理路由产品 Liquid Inference,对每一次推理请求运行实时拍卖,由服务提供方竞价承接,买方按符合自身约束的最低报价成交。据 MarkTechPost 10 月 8 日报道,开发者只需替换基础 URL 并保留原有代码,即可让提供方在价格上竞争。
该产品采用交易所式撮合机制。据 Architect 介绍,提供方发布针对特定模型的报价,每个请求都会在所有报出该模型的提供方之间竞拍,满足买方规则的最低报价胜出。Architect 是一家交易公司而非 AI 实验室,运营 AX 永续合约交易所,并于 2026 年 5 月收购了一家美国指定合约市场,拟在监管审核通过后上市 GPU 算力期货。公司称,其搭建金融交易所的经验被用于为推理构建双边价格发现。
据该公司介绍,整个流程分为四步:客户端发送标准的 OpenAI 或 Anthropic API 调用;买方约束条件筛选合格报价;报出该模型的提供方参与竞拍,符合条件的最低报价胜出;最高价格在生成开始前锁定,账单仅按实际计量用量结算。
买方可以设置单次任务成本上限、首 token 时延上限和最低吞吐量,也可以要求指定区域、零数据留存以及提供方或模型白名单,自动模式可为给定工作单元挑选模型。哈里森在领英帖子中补充说,产品支持路由规则预设和完整的多模态能力;账户持有人可以查看实时订单簿、按提供方和按模型的报价以及已清算交易。
在兼容性方面,该产品可接入 Claude Code、Codex、OpenCode、Cursor、Pi 和 Cline 等智能体编码工具。用户通过电子邮箱免费注册,前 500 名用户可获得 20 美元免费推理额度。推荐计划将所推荐用户费用的 20% 以免费推理额度返还,二级推荐另加 10%。
提供方通过 Liquid Inference 应用入驻。哈里森称,新提供方的验证在“几分钟而不是几周”内完成。所有提示词使用 OpenAI API 标准,REST 与 WebSocket API 用于注册模型和报价。提供方可以根据自身成本更新报价,从而只在愿意时出售闲置 GPU 算力。款项通过 Stripe 结算,每项任务都有明细记录。
与同类产品的差异方面,OpenRouter 采用价格加权负载均衡,按价格的平方反比分配,Hugging Face Inference Providers 默认选择最快提供方,可选 :cheapest 后缀。Architect 称 Liquid Inference 覆盖“数百个”模型,但未披露提供方数量;OpenRouter 提供 500 多个模型和 80 多家提供方,Hugging Face 列出 18 家合作方。价格上限上,Liquid Inference 在首个 token 前锁定最高价,OpenRouter 提供 max_price 参数,Hugging Face 未披露。数据控制上,Liquid Inference 支持零数据留存、区域限制和白名单,OpenRouter 支持 zdr、data_collection、only/ignore 等参数,Hugging Face 提供提供方偏好顺序。平台费用方面,Liquid Inference 未披露,OpenRouter 收取 5.5% 信用卡手续费、最低 0.80 美元且不加价,Hugging Face 不加价。免费额度方面,Liquid Inference 给前 500 名用户 20 美元,OpenRouter 未披露,Hugging Face 为每月 0.10 美元免费额度及 2.00 美元 PRO。公开市场数据方面,只有 Liquid Inference 提供实时订单簿和已清算交易。
Architect 目前尚未公开该产品的费率、提供方名单和时延数据。