跳到正文

OpenRouter

OpenRouter 模型路由平台动态:新模型上架、用量排行与开发者选型的真实市场信号。

最新精选

第 21–40 条 · 共 55 条
9月22日周二
  1. OpenRouter Blog62

    Nemotron 3.5 Lightning 是什么:30B-A3B 智能体执行模型解析

    OpenRouter 发文介绍 NVIDIA 的 Nemotron 3.5 Lightning,这是一款 30B 总参数、约 3B 激活参数的混合 Mamba-2 与 MoE 开源权重模型,面向高频智能体执行步骤,支持工具调用、编码与指令遵循。

    推荐理由:梳理了 Nemotron 3.5 Lightning 的规格、与 Ultra 的分工及路由与本地部署方式,便于评估智能体执行层选型。

  2. OpenRouter Blog62

    Jev 在分类任务上能否达到前沿模型的准确率?

    OpenRouter 用 Banking77 的 3,080 条客服语句对比 TypeSafe 的 Jev 1.13 与 Claude Opus 5,Jev 准确率 81.0%,落后 Opus 的 84.4% 约 3.3 个百分点,但中位延迟 175 ms 对 2,266 ms,每千次请求成本 $0.11 对 $2.42。

    推荐理由:用同一数据集对比小模型与前沿模型的准确率、延迟和成本,并给出按置信度级联的取舍方法。

  3. OpenRouter 模型目录62

    小米开源 MiMo-V2.6-Flash 基础模型

    小米发布开源基础模型 MiMo-V2.6-Flash,采用 MoE 架构,总参数 309B、每 token 激活 15B,并使用混合注意力机制。该模型已上架 OpenRouter 模型目录。

    推荐理由:材料给出 MiMo-V2.6-Flash 的参数量与架构要点,可据此了解小米开源模型的规格定位。

  4. OpenRouter 模型目录67

    SpaceXAI 在 OpenRouter 上架 Grok 4.7

    SpaceXAI 的旗舰模型 Grok 4.7 在 OpenRouter 上架,接替 Grok 4.6,面向编码、智能体任务和知识工作。该模型在长时间运行的软件工程任务和自我验证方面表现突出。

    推荐理由:Grok 4.7 在 OpenRouter 上架,读者可据此了解它在编码与智能体任务上的定位及与前代的关系。

9月21日周一
  1. OpenRouter 模型目录67

    阿里 Qwen 上架 Qwen3.8 Omni Flash 全模态推理模型

    阿里在 OpenRouter 上架 Qwen3.8 Omni Flash 全模态推理模型,官方称这是首个围绕智能体能力构建、具备原生音视频理解能力的 Qwen 模型。该模型适用于音视频分析与摘要等场景。

    推荐理由:Qwen3.8 Omni Flash 把原生音视频理解与智能体能力结合,可据此判断多模态推理模型的落地方向。

9月19日周六
  1. OpenRouter Blog62

    OpenRouter 实测 Jev 与 LLM:何时用决策模型而非生成文本

    OpenRouter 在 60 张客服工单上对比 TypeSafe 的决策模型 Jev 1.13 与 GPT Luna、Claude Opus,Jev 意图准确率 59/60、升级判断 60/60,每千张工单成本 0.0248 美元,GPT Luna 为 0.0921 美元,Claude Opus 为 2.88 美元。

    推荐理由:OpenRouter 用同一批工单对比决策模型与生成式 LLM 的成本和延迟,并给出可复用的路由与校验代码。

9月18日周五
  1. OpenRouter 模型目录60

    Z.ai 在 OpenRouter 上架 GLM-5.3-FlashX 高速多模态模型

    Z.ai 的 GLM-5.3-FlashX 已在 OpenRouter 模型目录上架,是 GLM-5.3-Flash 的高速变体,推理速度最高可达 200 tokens/s。该模型为原生多模态模型,沿用与 GLM-5.3-Flash 相同的混合稀疏与线性注意力架构。

    推荐理由:OpenRouter 上架 GLM-5.3-FlashX,读者可据此了解该高速多模态变体的推理速度与架构定位。

9月10日周四
  1. OpenRouter 模型目录70

    DeepSeek V4.1 Flash 上架 OpenRouter

    DeepSeek V4.1 Flash 在 OpenRouter 上架,是 DeepSeek 的稀疏 MoE 模型,也是首个基于其 Causal Encoder-Decoder(CED)架构构建的模型。该模型在输入端激活 8B 参数、在另一端激活 16B 参数。

    推荐理由:DeepSeek V4.1 Flash 上架 OpenRouter,可据此了解其 MoE 稀疏结构与 CED 架构的首次落地。

  2. OpenRouter 模型目录78

    DeepSeek 发布 V4.1 Flash 模型

    DeepSeek 在 OpenRouter 上架 V4.1 Flash,这是一个稀疏 MoE 模型,也是首个基于其 Causal Encoder-Decoder(CED)架构构建的模型。该模型在输入端激活 8B 参数,在输出端激活 16B 参数。

    推荐理由:DeepSeek V4.1 Flash 采用稀疏 MoE 与新的 CED 架构,可据此了解其参数激活方式与架构取向。

  3. OpenRouter Blog62

    OpenRouter Presets 使用指南:把 LLM 配置写成代码

    OpenRouter 发布 Presets 使用教程,介绍如何把模型选择、系统提示词、提供商路由和采样参数存成一个命名配置,在请求中用 "model": "@preset/your-preset-name" 引用。

    推荐理由:OpenRouter 官方教程,展示如何用预设把模型、提示词和路由配置从代码中抽离,适合多应用共用同一套 LLM 配置的团队参考。

9月9日周三
  1. OpenRouter Blog62

    Seedance 2.5 评测:它最擅长什么、什么时候该用

    OpenRouter 评测 ByteDance 的 Seedance 2.5,该模型自 2026 年 8 月 7 日上线其视频 API,支持 4 至 30 秒、480p 或 720p 生成,按视频 token 计费,480p 约每秒 0.103 美元、720p 约 0.231 美元。

    推荐理由:OpenRouter 用自家目录数据拆解 Seedance 2.5 的计费公式与适用边界,可据此判断长镜头和改片场景该选哪个视频模型。

  2. OpenRouter Blog62

    OpenRouter 推出美国区域路由,与欧盟路由一起保证数据驻留

    OpenRouter 在去年 10 月上线的欧盟路由基础上推出美国 In-Region Routing,请求发往 us.openrouter.ai 后在美国境内解密并只路由到美国供应商端点,eu.openrouter.ai 同理。

    推荐理由:原文区分了仅推理区域路由与端到端区域路由的差别,并给出可切换的域名和失败行为,便于评估数据驻留方案。

  3. OpenRouter 模型目录60

    Nex AGI 上架 Nex-N2.5-Mini 智能体模型

    Nex AGI 在 OpenRouter 上架 Nex-N2.5-Mini,属于 Nex-N2.5 系列。该模型定位为智能体模型,目标是把目标转化为可运行、可验证的结果,核心能力是在可视化反馈回路中进行智能体编码,可探索代码库并实现多文件改动。

    推荐理由:Nex AGI 新上架的小型智能体模型,读者可了解其在代码库探索与多文件实现上的定位。