配置步骤

  1. 在 CC Switch 打开已经保存的 青云TOP API Provider。
  2. 点击 Provider 卡片上的 配置用量查询
  3. 开启用量查询,预设模板选择 自定义
  4. 保持 {{apiKey}} 为掩码状态,不要在截图中显示完整令牌。
  5. 粘贴下面的配置:
({
  request: {
    url: "https://top.qingyuntop.ai/dashboard//api/usage/token/",
    method: "GET",
    headers: {
      "Authorization": "Bearer {{apiKey}}",
      "User-Agent": "cc-switch/1.0"
    }
  },
  extractor: function(response) {
    if (response.code === true && response.data) {
      return {
        isValid: true,
        planName: response.data.name,
        remaining: response.data.total_available,
        used: response.data.total_used,
        total: response.data.total_granted,
        unit: "quota"
      };
    }
    return {
      isValid: false,
      invalidMessage: response.message || "查询失败"
    };
  }
})
CC Switch 中 青云TOP API 用量查询脚本

青云TOP API 模型令牌用量查询脚本

亚太合作伙伴平台把域名改为 https://top.qingyuntop.ai/dashboard/。点击 格式化 检查语法,再点击 测试脚本保存配置

CC Switch 显示 青云TOP API 令牌用量

Provider 卡片已经显示 青云TOP API 已用与剩余额度

发布前检查

以下检查适用于客户端中选择 OpenAI 兼容Responses 提供商的场景;如果你选择的是 Anthropic、Gemini 等原生协议,请按对应协议的接口和返回结构配置。

  1. 模型 ID:先用目标 API Key 请求 GET https://top.qingyuntop.ai/v1/models,把返回的 data[].id 原样填入客户端。截图、教程和历史配置中的模型名不保证仍可用。
  2. 协议选择:新 OpenAI 集成优先选择 Responses;只有客户端或模型明确要求 Chat Completions 时才选择 Chat。Responses 的返回从 output 读取,Chat 的返回从 choices[].message 读取。
  3. Base URL:通常填写 https://top.qingyuntop.ai/v1,也就是只保留一个 /v1。要求完整接口地址的客户端才追加 /responses/chat/completions,不要重复追加。
  4. 流式与重试:流式响应必须按所选协议解析事件;连接中断后不要盲目重放可能已被服务端接受的生成请求。对 429 和 5xx 使用带抖动的退避,并设置连接、读取和总超时。
  5. 上线前验证:分别验证普通文本、流式文本、工具调用或结构化输出中实际用到的能力,并记录 request id、HTTP 状态、业务状态和完成原因,避免只根据 HTTP 200 判定成功。