前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片
  • 场景篇按分类整理的大前端场景考点
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
  • 动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
  • AI 助手随时提问,即时解析
  • AI 模拟面试模拟真实面试 + 报告
  • AI 知识地图串起全站知识点
  • AI 定制路线按你的简历现排
AI 热点
旧版
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片
  • 场景篇按分类整理的大前端场景考点
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
  • 动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
  • AI 助手随时提问,即时解析
  • AI 模拟面试模拟真实面试 + 报告
  • AI 知识地图串起全站知识点
  • AI 定制路线按你的简历现排
AI 热点
旧版
返回 AI 情报前线
All News · 全部资讯9663
  • AI安全测试全绿不代表真的安全
  • Claude Code 2.1.294 修复规则静默失效问题
  • LLM返回半有效JSON的正确处理方式
  • Jev 决策模型:让 AI 输出概率而非文字
  • AI 编程助长了哪些安全漏洞
  • AI 代理认证后到底继承了什么权限?
  • Google 推出跨应用统一 Gemini Agent 工作助手
  • AI 数学突破引发以太坊钱包安全性大讨论
  • 企业AI代理的隐形税:为何缺少基础设施上下文导致任务失败
  • Samsung Labs 开源亚 1-bit LLM 压缩:子因子分解新方法
  • Miro 两个月迁移 7 万测试用例:Jest 到 Vitest 实录
  • AWS Bedrock惊现严重漏洞:一个prompt可劫持账户所有Agent
  • Claude Sonnet 5.5评测:比 Opus便宜42%,每次运行表现一致
  • JetBrains开源Mellum2.1:面向编程Agent的12B MoE模型
  • 设计对AI Agent友好的可扩展API实践指南
  • Treg:面向 Agent 工具的 OpenRouter,按需调用千款 API
  • Ailoy:给 Agent 配备独立虚拟机的 Agent 开发框架
  • OctoGemma:本地运行的 Gemma 4 自主编程 Agent,支持 ReAct 自愈执行循环
  • 生产级语音 Agent 指挥中心:8 路并发 VAPI + Supabase Edge Functions 架构实战
  • AI渗透测试工具助单人攻破多家韩国银行,25万用户数据泄露
  • Architect推出Liquid Inference:实时拍卖LLM推理
  • 英伟达PivotOPD让多轮AI Agent学会从关键错误中恢复
  • OpenAI发布722篇AI数学发现,含黎曼假设相关成果
  • 程序员用 Claude Code 发现了一颗未知行星
  • Percona 推出 Redis 兼容代理清除 Valkey 迁移最后障碍
  • Google推开发者知识API与MCP Server公开预览
  • Vibe Coding必须补上QA验证环节
  • Perplexity发布 pplx-embed-v2:0.6B边缘Embedding模型
  • rea: MCP 逆向工程工具,可无源码分析应用行为与二进制
  • EmbeddingGemma 2: Google 开源多模态嵌入模型,支持动态维度截断
  • 144M 小模型承担 Agent 82% 决策调用,绕过大模型降本 95%
  • Excel 日期转换:45366 不是 Bug,是格式而非值
  • 10 行 Python 守卫防止 AI Agent 耗尽预算
  • AI智能体的真值困境:多个冲突信源谁来仲裁
  • GPT-6发布:内置可交互UI组件,Haiku 5.5降价75%
  • GPT-6向免费用户开放,智能体响应速度提升44%
  • AI Agent 可观测性实战:追踪链路、成本分析与故障根因
  • Claude新模型跑分超越GPT-6 Luna,价格更低
  • Claude Haiku 5.5 定价暗藏玄机:超 10 万 token 费用暴涨 5 倍
  • LLM 完成 TypeScript 编译器到 Rust 的移植
  • OpenAI Decisions API公开beta,支持图像输入快速决策
  • Claude Haiku 5.5 定价解析:超 10 万 token 后性价比骤降
  • Agent 置信度层:何时判定模型「不知道」
  • Claude Haiku 5.5 正式发布:百万上下文、百万 token 仅 $0.10
  • 让 AI Agent 变得无聊:确定性层设计
  • GitHub Copilot 已上线 Claude Haiku 5.5
  • DeepGEMM 开源:英伟达 GPU 高性能 GEMM 内核库
  • Python Master-Agent遥测诊断框架:PSC架构解析
  • 如何防止AI Agent向诈骗者付款:地址风险检查实战
  • x402支付第四大陷阱:无支出策略导致的钱包耗尽
  • GPT-6 发布:ChatGPT 新增交互式 UI,可生成图表按钮
  • 已加载 51 / 9663
8.0
热点
AI SCORE
编程提效2026-10-08 16:53

Architect推出Liquid Inference:实时拍卖LLM推理

MarkTechPost#LLM推理#成本优化#开发者工具
Editor brief · 编辑速览

Architect Financial Technologies推出Liquid Inference,为每次LLM调用实时竞价的推理路由平台, providers竞争出价,买家按满足规则的最低价付费;开发者仅需切换base URL即可接入。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

Architect Financial Technologies 推出了 Liquid Inference,这是一款 LLM 路由器,可针对每个请求实时竞拍。Liquid Inference 是 Architect 旗下的 LLM 推理市场,提供商在此为每个 prompt 出价竞标。买方支付满足其规则的最低报价。对开发者而言,消息很简单:更换一个 base URL,保留你的代码,让提供商在价格上竞争。

什么是 Liquid Inference?

Liquid Inference 是交易所风格的 LLM 推理路由器。据 Architect 介绍,提供商发布报价以服务特定模型,每个请求都会在所有报价该模型的提供商之间进行拍卖,满足买方规则的最低报价者赢得请求。

该产品来自一家交易公司,而非 AI 实验室。Architect 运营着 AX 永续期货交易所。2026 年 5 月,它收购了一个美国指定合约市场(Designated Contract Market)以上市 GPU 计算期货,目前正在等待监管审批。团队利用其构建金融交易所的经验,为推理创造了双向价格发现机制。

推理拍卖如何运作?

流程分为 4 个步骤:

Request:客户端发送标准的 OpenAI 或 Anthropic API 调用。

Rules:买方的约束条件过滤出符合条件的报价。

Auction:报价该模型的提供商相互竞争,满足条件的最低报价者胜出。

Receipt:max price 在生成之前锁定,账单仅涵盖实际计量用量。

买方可以设置每任务成本上限、首个 token 到达时间限制和最低吞吐量。也可以要求特定区域、零数据保留以及提供商或模型白名单。Auto 模式可以为给定工作单元自动选择模型。Harrison 的 LinkedIn 帖子补充了路由规则预设和完整的多模态支持。

账户持有者可以查看实时订单簿、提供商和模型报价以及已结算交易。这种级别的市场数据在 LLM API 中并不常见。

与 agentic 编程工具的零改动兼容。帖子列出了 Claude Code、Codex、OpenCode、Cursor、Pi 和 Cline。

免费邮件注册。前 500 名用户获得 $20 的免费推理额度。

推荐计划:被推荐费用的 20% 作为免费推理额度,外加二级推荐 10%。

推理提供商获得什么?

提供商通过 Liquid Inference 应用入驻。Harrison 表示,新提供商在"几分钟内而非数周"内完成验证。所有 prompt 均使用 OpenAI API 标准。REST 和 WebSocket API 用于注册模型和报价。

提供商可以根据自身成本更新报价,这让他们仅在想出售时才能出售闲置 GPU 容量。款项通过 Stripe 结算,每项任务都有逐项明细记录。

Liquid Inference 与 OpenRouter 和 Hugging Face 相比如何?

特性 Liquid Inference OpenRouter Hugging Face
推理提供商路由模型 按请求在报价提供商间拍卖 价格加权负载均衡,价格的平方倒数 默认最快提供商;可选 :cheapest 后缀
模型 / 提供商数量 "数百"个模型;提供商未公开 500+ 模型,80+ 提供商 18 个已列出合作伙伴
API 兼容性 OpenAI 和 Anthropic 兼容 OpenAI 兼容 OpenAI 兼容,仅聊天
价格上限 首个 token 前锁定 max price max_price 参数 未披露
数据控制 ZDR、区域、白名单 zdr、data_collection、only/ignore 提供商偏好顺序
平台费 未披露 5.5% 信用卡费,$0.80 最低消费 无加价
免费额度 前 500 名用户 $20 未披露 $0.10/月免费,$2.00 PRO
公开市场数据 实时订单簿和已结算交易 未披露 未披露

Liquid Inference 在竞争的提供商之间对每个 LLM 请求进行拍卖。

max price 在首个 token 前锁定,每任务有独立收据。

兼容 OpenAI 和 Anthropic 客户端,包括 Claude Code 和 Cursor。

前 500 名用户获得 $20 免费;推荐可获得费用的 20%。

费用、提供商列表和延迟数据尚未公开。

查看 Technical details。所有荣誉归该项目研究者所有。另外,记得在 Twitter 上关注我们,不要忘记加入我们的 150k+ ML SubReddit 并订阅我们的 Newsletter。等等!你用 telegram 吗?现在你也可以加入我们了。

Michal Sutter 是数据科学专业人士,拥有帕多瓦大学数据科学硕士学位。凭借统计分析、机器学习和数据工程的坚实基础,Michal 擅长将复杂数据集转化为可操作的洞察。

Original source

本文由 AI 翻译整理自 MarkTechPost,原文版权归原作者所有。

阅读英文原文
上一篇
AI渗透测试工具助单人攻破多家韩国银行,25万用户数据泄露
下一篇
英伟达PivotOPD让多轮AI Agent学会从关键错误中恢复