BlockBeats 消息,7 月 22 日,AI 支付基础设施 Kite 生态推出面向长时运行 AI Agent 的自适应推理基础设施 Marathon。该服务允许用户为每个请求选择「now / soon / later / anytime」四档完成窗口,等待时间越长价格越低,最深档位较实时价格最多可节省约 65%(折扣为预估值,随实时容量浮动)。Marathon 的 API 与 OpenAI 兼容,并为 Claude Code 与 Codex 提供一行命令安装的插件,降低了开发者的接入门槛。
正文解读
要点:Marathon 首发支持五款头部开放权重模型,包括 Kimi K3、GLM 5.2、DeepSeek V4 Pro、Qwen3.6-35B-A3B 和 Nemotron 3 Ultra,全部适用统一定价规则。这意味着开发者可以在不同模型之间灵活切换,无需为每个模型单独协商定价或对接接口。对于运行大规模推理任务的 Agent 应用而言,这种按时间换取成本的模式有望显著降低算力开销。
Marathon 的推出背景是 Kite 此前完成由 PayPal Ventures 与 General Catalyst 领投的总额 3300 万美元融资。从支付基础设施切入推理层,Kite 正在将其在 Agent 支付网络上的积累延伸至底层算力调度,旨在打通 Agent「自主调用、自主付费」的完整闭环。这一布局反映了当前 AI 基础设施赛道的一个重要趋势:支付与算力的边界正在模糊,越来越多的基础设施层玩家开始同时提供这两类服务。
从行业视角看,Marathon 的差异化在于不追求实时响应,而是针对非实时、长时运行的 Agent 任务提供廉价算力。这类场景在数据分析、批量处理、自动化工作流等领域广泛存在,但此前缺乏专门的推理基础设施来匹配其成本敏感特性。如果折扣力度符合预期,Marathon 可能吸引一批对延迟容忍度较高但对价格敏感的开发者群体。
需要提醒的是,文中提及的折扣为预估值,实际节省幅度取决于实时容量和网络负载。此外,Marathon 目前仅支持特定开放权重模型,模型覆盖面能否快速扩展将直接影响其市场竞争力。感兴趣的用户可访问官网 marathon.build 获取更多信息。
原创文章,作者:admin,如若转载,请注明出处:https://www.23btc.com/203366/



