跳到正文
原文
OpenRouter Blog·· 17 天前精选AI 评分62

Jev 在分类任务上能否达到前沿模型的准确率?

Is Jev as Accurate as Frontier Models at Classification?

AI 导读

OpenRouter 用 Banking77 的 3,080 条客服语句对比 TypeSafe 的 Jev 1.13 与 Claude Opus 5,Jev 准确率 81.0%,落后 Opus 的 84.4% 约 3.3 个百分点,但中位延迟 175 ms 对 2,266 ms,每千次请求成本 $0.11 对 $2.42。

推荐理由

用同一数据集对比小模型与前沿模型的准确率、延迟和成本,并给出按置信度级联的取舍方法。

来源:OpenRouter Blog · openrouter.ai