全局作用于阿里云和自建 LLM;单次请求显式传参时仍以请求参数优先。保存后通过 Nacos 热更新,无需重启。
按真实请求异步复制到指定模型,影子结果不会返回给用户;失败、超时和过载均与主链路隔离。保存后通过 Nacos 热更新。
默认把整个 API Key 切到 turing-llm-next(100%)。高流量客户可以先调低比例、逐步放量。 其余流量走阿里云;自建 LLM 不可用时自动回退阿里云。不在表里的客户全部走阿里云。
使用与工单系统相同的图灵 SSO 登录。