Routescope APIRoutescope API
客户端工具配置

如何把简单任务路由到 Qwen / DeepSeek 降低成本

说明如何在请求或客户端里选择 Qwen / DeepSeek,把摘要、分类、改写等简单任务发给更合适的模型。

你能直接控制的是每次请求里的 model:简单任务填 Qwen / DeepSeek 的模型名,复杂任务再填 OpenAI / Claude 等更强模型。

第一步:确认可用模型名

先打开模型广场,找到当前账号可用的 Qwen / DeepSeek 模型,并复制完整模型名。也可以用模型列表接口查看:

curl https://api.routescope.ai/v1/models \
  -H "Authorization: Bearer sk-your-token"

后面的示例里,记得把 your-qwen-modelyour-deepseek-modelyour-strong-model 换成你账号里真实可用的模型名。

第二步:简单任务直接请求 Qwen / DeepSeek

例如摘要、分类、格式转换、短文本改写这类任务,可以直接把请求里的 model 改成 Qwen / DeepSeek。

curl https://api.routescope.ai/v1/chat/completions \
  -H "Authorization: Bearer sk-your-token" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "your-qwen-model",
    "messages": [
      {
        "role": "user",
        "content": "把下面这段内容总结成三条要点:..."
      }
    ],
    "max_tokens": 400
  }'

如果你用的是 Codex、VS Code / Cline、OpenCode 这类 OpenAI Compatible 客户端,就在客户端的模型配置里填写这个 Qwen / DeepSeek 模型名。Base URL 仍然是:

https://api.routescope.ai/v1

第三步:在业务代码里按任务选择模型

如果你能改自己的业务代码,可以按任务类型自动选择模型。下面的示例只需要 API Key 和模型名。

const SIMPLE_TASK_MODELS: Record<string, string> = {
  summarize: "your-qwen-model",
  classify: "your-qwen-model",
  rewrite: "your-deepseek-model",
  translate: "your-qwen-model",
};

function pickModel(taskType: string) {
  return SIMPLE_TASK_MODELS[taskType] ?? "your-strong-model";
}

const completion = await client.chat.completions.create({
  model: pickModel(taskType),
  messages,
  max_tokens: taskType === "classify" ? 200 : 1000,
});

推荐选择

任务类型推荐模型方向配置建议
分类、标签、意图识别Qwen / DeepSeek请求里填写低成本模型,并限制输出格式。
摘要、改写、翻译Qwen / DeepSeek控制 max_tokens,先用低成本模型测试质量。
批量数据清洗Qwen / DeepSeek分批请求,用操作记录观察平均消耗。
复杂代码生成OpenAI / Claude / 强推理模型不建议只按低成本优先,先看质量和失败率。
关键生产回复强模型,必要时加客户端备用模型在自己的代码里做失败兜底。

降低成本的小技巧

  1. 分类和抽取任务把输出格式写清楚,例如“只返回 JSON,不要解释”。
  2. 给简单任务设置较小的 max_tokens,避免模型生成过长内容。
  3. 批量任务先抽样测试 20 到 50 条,确认质量和消耗后再扩大。
  4. 不要手写猜模型名,始终从模型广场或 /v1/models 复制。

验证是否真的省钱

发起测试请求后,进入操作记录查看:

检查项看什么
请求模型是否是你填写的 Qwen / DeepSeek 模型。
状态是否成功,失败时查看错误原因。
token输入、输出 token 是否符合预期。
消耗和强模型测试请求对比,是否明显降低。

如果请求失败,优先检查模型名是否在当前账号可用、Base URL 是否为 https://api.routescope.ai/v1、API Key 是否完整。

最后更新于