


推荐理由:腾讯混元3不是靠宣传,而是靠数据跑到了OpenRouter第一,工具调用和编码双双登顶,国产模型在海外开发者的真实接受度比想象中高得多。
OpenRouter 模型路由平台动态:新模型上架、用量排行与开发者选型的真实市场信号。



推荐理由:腾讯混元3不是靠宣传,而是靠数据跑到了OpenRouter第一,工具调用和编码双双登顶,国产模型在海外开发者的真实接受度比想象中高得多。
推荐理由:OpenRouter 拆解了 GPT 5.5 的实际成本,49-92% 的涨价被输出 token 减少部分抵消,用 API 的人必须算的一笔账。
OpenAI 将 GPT-5.5 的按 token 计价提高了一倍,但新模型在输出上更为简洁。通过实际使用测量发现,尽管单价上涨,由于模型响应更精炼、消耗的 token 数量减少,最终净成本影响可能低于预期。关键变化在于单位价格与模型效率之间的平衡,实际支出需结合具体使用场景和生成长度综合评估。
推荐理由:OpenAI 把 GPT-5.5 的单价翻倍让很多人心凉,但 OpenRouter 的实测显示净成本变化没那么大。如果你用 API 构建应用,这篇能帮你冷静算账。
OpenAI 将 GPT-5.5 的每 token 价格翻倍,但模型输出更精简(less verbose)。OpenRouter 通过实测用量评估了净成本变化。
推荐理由:OpenRouter 用真实 API 数据算了 GPT-5.5 的净成本,虽然单价翻倍但实际涨幅比想象中小,API 用户值得一看。
推出响应缓存功能:在测试和智能体重试上节省大量资金与时间。 博客文章:https://openrouter.ai/announcements/response-caching 免费提供。了解更多 👇
推荐理由:OpenRouter 的 Response Caching 直击测试和 agent 重试的浪费痛点,免费能用,做 API 集成的开发者可以立刻省下一笔预算。
@levelsio openrouter 在模型名称里有一个很酷的“nitro”标志,用来使用最快的提供商 所以就像“gpt-5.5:nitro” 如果实验室们能让你直接用“latest”之类的就好了
推荐理由:OpenRouter 这个 -latest 别名很实用,不用每次都改模型版本号,对大量调用 API 的团队是个省心更新,痛点精准。
OpenRouter 正式上线文本转语音和音频转录功能。平台通过两个新的 API 端点,集成了多家供应商的语音合成与音频转录服务。用户现在可以统一调用单一 API,便捷访问多提供商的高质量语音生成与语音转文本能力,无需再为不同服务商单独集成。这简化了开发流程,为应用添加语音交互与内容转录功能提供了更高效的一站式解决方案。
推荐理由:OpenRouter把语音合成和转录也接进来了,以后做语音应用的开发者可以少对接几个API,这是把‘省事’写进DNA的典型更新。
推荐理由:Grok-4.3 降价但性能反升,agentic 跑分直接到 1500,如果之前觉得 Grok 贵而没试过,这次可以上车了。
OpenRouter 新增 Response Caching 头部,用于缓存完全相同的 API 请求,使后续请求的响应时间大幅缩短,且缓存调用完全免费。
推荐理由:OpenRouter 这波缓存功能很实在,相同请求零费用,对频繁调用的开发者是省钱利器。可惜 42 天前的东西,现在只能当文档翻翻。
新推出的 Response Caching 头部实现了 API 请求的缓存机制,完全相同的请求可获得缓存响应,响应时间大幅缩短至微乎其微的水平,且不会产生额外成本。该功能通过自动识别并复用已生成的响应,显著提升了重复请求的处理效率。
推荐理由:OpenRouter 这次更新的响应缓存,直接让相同请求免费用,对频繁调用的场景是个省钱加速的好功能,用过 API 的人都能立刻明白它的价值。
运行 `stripe projects add openrouter/api` 即可从命令行创建 OpenRouter 账户、获取 API 密钥并配置 Stripe 计费。AI 智能体同样可自动化完成该操作,无需手动注册。
推荐理由:OpenRouter 把注册和计费全塞进一条 CLI 命令,Stripe Projects 加持,agent 都能自己开户了,重度 API 玩家可以省点事,不过就一工具链缝合,不打开也知道。
运行 `stripe projects add openrouter/api` 命令,即可直接从命令行创建 OpenRouter 账户、获取 API 密钥并开通 Stripe 计费功能。该操作支持自动化代理执行,实现了账户开通与支付配置的一站式集成。
推荐理由:OpenRouter 把账户创建搬到了 CLI,你的 agent 也可以直接开号了,这对于需要自动化计费流程的开发者是个便利小更新,但普通用户几乎感受不到变化。
推荐理由:Nemotron 3 Nano Omni 是 NVIDIA 在开源多模态模型上的新动作,30B 参数 MoE 架构、256k 上下文、四模态输入,做 Agent 工作流的开发者值得试一下,尤其文档和音视频推理场景。
推荐理由:OpenRouter 用自家平台数据实测 Opus 4.7 的真实成本变化,不是官方 PR 而是第三方视角,做成本预算的产品人和开发者值得看一眼再决定要不要迁移。
@poolsideai 的首批公开基础模型刚刚在 OpenRouter 上发布! Laguna M.1 和 Laguna XS.2。专为智能体编码和长周期工作从头构建。限时免费 ⬇️
推荐理由:Poolside 终于把自家模型放出来了,主打长上下文 agentic coding,免费期是薅羊毛窗口。做 coding agent 的团队值得拿 Laguna 跑一轮自己的 benchmark,看看和 Claude、Codex 的真实差距。
Anthropic在Claude Opus 4.7版本中更新了分词器。通过对比4.6到4.7版本的实际使用数据,分析发现这一技术调整改变了文本转换为令牌的方式,直接影响API计价。相同的文本输入可能产生不同数量的令牌,从而导致用户的实际使用成本发生可量化的变化。这一调整虽不改变模型能力,但关乎运营开销,是开发者和企业用户需评估的关键因素。
推荐理由:Opus 4.7 换了 tokenizer,大多数人只知道模型变强了,不知道计费逻辑也变了。OpenRouter 用真实流量数据算了一笔账,做成本预算的产品人值得扫一眼。
OpenRouter Agent SDK 提供 create-agent-tui 和 create-headless-agent 两种技能,可在几分钟内脚手架搭建个性化编码智能体。前者附带终端 UI,后者为无头模式,适用于脚本与管道自动化场景。
推荐理由:虽然隔了一个多月,但这个官方教程把 Agent SDK 的脚手架玩法拆得很透,想自己搭 coding agent 的开发者抄一遍就能跑起来,省得从头写 harness。
OpenRouter Agent SDK 提供 `callModel` 函数,能将聊天补全转换为支持工具调用、停止条件和成本追踪的多步智能体,覆盖 300 多个模型。
推荐理由:OpenRouter把agent构建压缩进一个callModel函数,内置工具调用、停止条件和成本追踪,对已在它生态里的开发者省下不少样板代码,可惜时效过了。
OpenRouter Agent SDK 提供 callModel 函数,将单次聊天补全转换为支持工具调用、停止条件与成本追踪的多步智能体工作流,覆盖 300 多个模型。
推荐理由:如果你在用 OpenRouter 拼 agent,这个 SDK 把多模型调用和工具链包成一行 callModel,省了适配 300+ 模型的体力活,值得看一眼。
OpenRouter Agent SDK 推出 `create-agent-tui` 和 `create-headless-agent` 两类技能(skills),用于快速搭建(scaffold)个性化编码智能体。前者提供终端 UI(terminal UI),后者为无头模式(headless),适用于脚本和流水线(scripts and pipelines)。
推荐理由:一个用 OpenRouter Agent SDK 快速搭建编码 agent 的脚手架,适合想省时间的开发者,但内容本身是常规文档,42 天前的教程现在已经没什么新意。