Agent Arena 跑了 4700 多场真实会话测 Jev Router,结论挺直接:比 DeepSeek V4.1 Flash 贵 38%,但根据反馈换模型的能力接近 Claude Opus 5.5。
#模型路由
有人实测了 Jev Router,5 个常用模型里 4 个上了 Pareto 前沿,但直连 DeepSeek V4.1 Flash 反而更便宜更快,选路由前可以先看看这组数据。
Legora 的 CEO 说选法律 AI 别纠结哪个模型最强,他们直接做了套路由系统,按任务自动挑模型,窄任务还自己微调小模型。
Cline 新上了个 Pareto 26.10 Preview,能同时跑几个模型挑最好的答案,同样的 DeepSWE 成绩只要 Fable 五十六分之一的钱。
LangChain 把自家编码 Agent 的账单连续两个月打下来了,三个做法都能直接抄:LangSmith 记账、gateway 设上限、OpenSWE 做模型路由。
华为把 X-Router 开源了,跑 Agent 时简单任务走便宜小模型,复杂任务才上大模型,成本能砍一半左右,做 Agent 的可以试试。
LangChain 出了个 ModelRouterMiddleware,读你第一条消息就自动挑模型,还能每次工具返回后换模型,15分钟就能搭出来。
OpenRouter 创始人首次开聊被 Stripe 收购的内幕,还聊到多家模型混用、企业降成本,以及为啥他觉得 10 个专才智能体比一个超级智能体更好用。
Jev 不再只是个小模型,现在靠几百个实例投票帮你路由到 Opus 5.5 或 GPT-6 Astra,只用 40% 的钱拿到 99% 的跑分,省钱党快看。
OpenRouter 把 Jev Router 选模型的理由摊开给你看:每轮用了哪个模型、任务难度和精度怎么评分的,想搞懂路由逻辑的可以直接去玩玩。
TypeSafe 做了个叫 Jev 的路由模型,每轮对话前给你的提示词打分,判断该用贵模型还是便宜模型,省钱和保质量二选一的问题它替你算。
Stripe 为啥买下 OpenRouter?两位创始人亲述,日路由 10T+ tokens 的生意和智能体欺诈隐患都讲透了。
一篇把拍卖机制套到 LLM 采购上的论文,Llama 和 Qwen 实测显示固定定价比竞价贵 10% 到 71%,做 API 成本优化的可以看看思路。
Jev 在 Vercel AI Gateway 免费到 9 月 25 日,官方还配了表单路由模板,想自动分流表单提交可以直接套用。
在用 LangChain 跑 managed deep agents 的话可以试试 Jev 中间件,写好路由规则它就帮你自动挑模型。
OpenRouter 推荐了 Ori DeepSeek,每次启动自动拉新模型,加 /fast 或 /zdr 就能控制路由和留存,挺省心。
OpenRouter把/model变成你的专属目录,加/speed选最快路由,加/zdr选零保留,设置一次会话内都管用。
NVIDIA开源了30B MoE,激活才3B,跑起来便宜,还配了个路由器帮你省钱,搞智能体的可以看看。