跳到正文
北京时间

OpenRouter

OpenRouter 模型路由平台动态:新模型上架、用量排行与开发者选型的真实市场信号。

158条精选相关主题部署工程模型发布开源生态

最新精选

第 61–80 条 · 共 158 条
6月16日周二
6月14日周日
6月13日周六
  1. OpenRouter:Announcements(RSS)59

    OpenRouter 可靠性与自动故障转移:请求如何持续成功

    OpenRouter 默认启用提供商故障转移(provider failover),模型回退(model fallbacks)则为选择加入。这两层机制分别应对不同类型的故障:提供商故障转移在 API 调用失败时自动切换至其他提供商,模型回退则在指定模型不可用时切换到备选模型。公告详细说明了各层的工作原理以及故障转移的停止条件。

    推荐理由:开发 LLM 应用的人可以把这篇当生产可靠性检查清单用,虽然通篇在推自家服务,但两层故障转移的思路确实通用。

  2. OpenRouter:Announcements(RSS)66

    OpenRouter 模型路由工作原理

    OpenRouter 将每个请求路由到 60 多家提供商,用户可自定义提供商顺序、价格上限和回退链,从而灵活控制路由策略。

    推荐理由:如果你在用 OpenRouter,这篇把默认的逆向平方权重、:nitro/:floor 快捷方式和 model fallback 逻辑讲得很清楚,读完就能调整请求策略。

  3. OpenRouter:Announcements(RSS)74

    Hermes Agent 在 OpenRouter 上的使用指南:设置、模型与路由

    Hermes Agent 已通过 OpenRouter 处理超过 17 万亿 tokens。使用指南包括设置流程、选择支持 64K 上下文窗口的模型,以及调整路由策略以兼顾成本与可靠性。

    推荐理由:OpenRouter 这篇教程把 Hermes Agent 的配置、路由和降本技巧都讲透了,刚上手的人照着走就能跑起来,而且给出了廉价辅助模型的省钱套路,实用性强。

  4. OpenRouter:Announcements(RSS)64

    如何在OpenRouter上获得最低成本的LLM推理

    在OpenRouter上追加`:floor`可获取最便宜提供商,通过`max_price`设定花费上限,并可免费使用20多个零成本模型。同时需注意避免计费陷阱。

    推荐理由:如果你是 OpenRouter 的开发者,这篇教程把成本控制的开关全摆出来了,从 :floor 到免费模型再到 BYOK 的成本账,看完就能立刻调配置省钱。

6月12日周五
  1. OpenRouter:Announcements(RSS)69

    Advisor:让任何模型在生成过程中求助更强的模型

    OpenRouter 推出 advisor 服务器工具,允许快速、便宜的模型在生成过程中向更强模型咨询。用户可用 GPT-4o Mini 处理常规任务,在关键环节调用 Claude Fable 进行更高质量的推理。

    推荐理由:让 GPT-4o Mini 在关键时刻请教 Claude,用 1/10 的成本得到相近质量,这种跨模型顾问把“模型路由”做成了开箱即用的工具,做 agent 的值得试。

  2. OpenRouter66

    终于能一目了然地查看你的顶级人类与顶级 AI 智能体了。 附带一个 API,可随时间查询你所有的数据 📊

    引用OpenRouter@OpenRouter

    今天我们正式推出 OpenRouter 上的全新 Activity 探索器。 这是查看您和团队在每个模型上的支出、模型 token、缓存命中率、智能体以及趋势的最佳方式。所有数据实时更新。 看看我们的团队是如何使用 Fable 及其他模型的 👇

    推荐理由:如果你团队在用 OpenRouter 接各种模型,这个 Activity Explorer 终于让你能看清每个人和每个 Agent 分别花了多少 token、命中了多少缓存,费用透明了,对工程管理很有用。

  3. OpenRouter:Announcements(RSS)55

    OpenRouter:企业应转向多模型路由,放弃单一LLM供应商

    OpenRouter指出,企业不应只依赖一家LLM供应商,而应采用多模型路由策略以平衡成本与效果。Anthropic Opus 4.7的“tokenizer税”导致输入token增加35%,新模型Fable定价$10/M输入、$50/M输出,OpenAI GPT-5.5 Pro更高达$30/M输入、$180/M输出。用户正主动跨模型族分配任务,平台3月至4月新增90个模型。OpenRouter作为统一市场,通过标准化API消除切换成本,使路由成为“一等公民”。

    推荐理由:OpenRouter 放出的多模型使用数据很实在,成本压力正推动企业从专一走向多模型路由,新分析 API 让这个趋势可度量。

6月11日周四
  1. OpenRouter:Announcements(RSS)64

    Gemini 2.5 Flash API - 定价、快速入门与提供商比较

    Gemini 2.5 Flash API 支持配置思考预算(thinking budgets),用户可跨提供商进行比较,并在5分钟内完成首次API调用。

    推荐理由:这是 OpenRouter 上接入 Gemini 2.5 Flash 的保姆级指南,把三家 Google 提供商的延迟和定价差异摆在明面上,需要做模型选型和成本估算的开发者可以直接抄里面的 quickstart 代码。

6月10日周三
  1. OpenRouter66

    今天,我们在 OpenRouter 上推出了新的 Activity explorer。 这是查看你和团队在每个模型上花费了多少的最佳方式,还包括 token、缓存命中率、智能体以及趋势。所有数据实时更新。 看看我们的团队如何使用 Fable 和其他模型 👇

    推荐理由:OpenRouter 把花费追踪做成实时面板,对重度依赖模型路由的开发者是个实用小升级,但零账户用户直接跳过。

  2. OpenRouter:Announcements(RSS)75

    OpenRouter 推出 Advisor 工具:让低成本模型可随时调用强模型增强生成

    OpenRouter 发布 advisor 服务器工具,允许一个快速、便宜的模型在生成过程中咨询一个更强大的模型。具体而言,可用 GPT-4o Mini 处理日常例行工作,在关键时刻调用 Claude Fable 解决真正重要的问题,从而实现成本和质量的动态平衡。

    推荐理由:OpenRouter 开放了跨模型顾问调用,让便宜模型在关键节点求助昂贵模型,这会让 agent 开发重心从选一个万能模型转向编排一组模型,值得所有做 agent 架构的人试一下。

  3. OpenRouter:Announcements(RSS)60

    Gemini 2.5 Flash API:定价、快速入门与提供商对比

    Gemini 2.5 Flash API 的定价与快速入门指南,指导用户配置 thinking budgets、比较不同提供商,并在 5 分钟内完成首次 API 调用。

    推荐理由:Gemini 2.5 Flash 最值得关注的是 thinking budget,这篇教程把怎么用、怎么省都讲清楚了,但对早已熟悉文档的开发者来说新东西有限。

6月9日周二
6月8日周一
  1. OpenRouter:Announcements(RSS)63

    OpenRouter Agent SDK 推出 HITL 工具:满足 EU AI Act、Colorado ADMT 与 NIST AI RMF 合规要求

    OpenRouter 的 Agent SDK 新增人类参与循环(HITL)工具,用于 AI 智能体的合规监督。该工具可帮助 AI 智能体满足欧盟 AI 法案、科罗拉多州自动化决策技术法(SB26-189)以及 NIST AI 风险框架(NIST AI RMF)的监管要求。

    推荐理由:8 月就是欧盟 AI 法案高风险的生效日,这个教程把三个监管框架的 HITL 要求变成可直接复用的代码,做金融医疗代理的开发者该收藏。

6月6日周六
  1. OpenRouter:Announcements(RSS)75

    OpenRouter 30 场 AI 大逃杀:11 个 LLM 对决,Claude 与 Grok 谁更优?

    OpenRouter 展开了 30 场 AI 大逃杀式对比,涉及 11 个大语言模型,共消耗 482 美元推理费用。实验得出一个发现,该发现应改变用户阅读模型基准测试的方式。

    推荐理由:这场大逃杀实验把模型对齐税摆上了台面,Grok因少斟酌、多行动而胜出,Claude的犹豫反而是现实场景里更需要的品质,选模型不能只看赢不赢,要看任务需要什么性格。