跳到主要内容
feedback
feedback

模型智能路由

模型智能路由根据任务难度,从你配置的基础、标准、高级三档中自动选择模型。接入时,将原来的模型名称改为 auto 即可。

开放范围

目前仅面向部分组织内测,仅已开放组织的成员可使用,个人空间暂不支持。

配置路由

在组织工作台左侧选择 治理 → 模型智能路由,进入 配置 页。

  1. 打开 启用模型路由 开关。
  2. 为基础、标准、高级三个档位分别选择模型。
  3. 点击 保存配置。需要恢复平台默认模型搭配时,点击 恢复默认配置

模型智能路由配置:启用开关及基础、标准、高级三档模型选择

图中模型为示例,实际可选模型以控制台为准。

档位适用场景
基础档简单任务,侧重效率与经济性
标准档日常使用,兼顾性能与成本
高级档复杂与关键任务,侧重输出质量

可选模型以页面下拉列表为准。路由配置在控制台完成,不支持在单次 API 请求中自定义路由档位、候选模型或路由策略

开始使用

准备好用于当前组织空间的 API Key(访问令牌)。令牌的创建与授权方式见 访问令牌管理

在工具中使用

在支持 OpenAI 兼容接口、可自定义模型名称的工具中填写:

配置项填写内容
API 地址(Base URL)https://ai.gitee.com/v1
API Key你的访问令牌
模型名称auto

如果工具原本已经接入模力方舟,只需将具体模型名称改为 auto

在代码中调用

使用 Chat Completions 接口,将 model 设为 auto。以下示例中的 YOUR_API_KEY 需要替换为你的访问令牌。

先安装 OpenAI Python SDK:pip install openai

from openai import OpenAI

client = OpenAI(
base_url="https://ai.gitee.com/v1",
api_key="YOUR_API_KEY",
)

response = client.chat.completions.create(
model="auto",
messages=[{"role": "user", "content": "用三句话介绍大语言模型。"}],
)

print(response.choices[0].message.content)

其他接口参数见 API 文档

查看路由统计

切换到 统计 页,选择日期范围,单次最多查询三个月。

路由统计:日期筛选、费用与节省、模型使用情况及节省成本分布

图中数据仅用于展示界面,不代表实际节省承诺。页面展示:

  • 费用与节省:总节省金额、节省比例、高级档基准费用和实际费用。
  • 模型使用情况:基础、标准、高级三档的成功调用量。
  • 节省成本分布:各档位的节省金额与贡献率。

仅统计本空间内由你创建的 API Key 的智能路由调用。费用与节省率基于同一批可比较的成功调用:实际费用及高级档历史基准费用均有效,且基准试算成功。

节省金额为基准费用减去实际费用,节省率为节省金额除以基准费用。负值表示费用高于基准, 表示比例无法计算。费用可能包含资源包等价费用,不等同于钱包现金扣款。