比如我的某个提供商有两个密钥 K1 和 K2
各自的提供商模型是 K1 {A, B}, K2 {B},启用了自动获取模型,但是其中 K1 禁止了 A。
如果我配置了客户端模型 A 可以路由到提供商模型 A 和 B。
但是实际上会向 K1 请求 A 模型,于是乎成功后不会请求 B 模型。
如果是先向 K2 请求,也会尝试先请求 A 模型,然后上游会返回无该模型的失败信息,然后就会转到 K1 请求 A 模型。
预期效果:
如果是向 K1 请求 A 模型,应该路由到 B 模型。
如果是向 K2 请求 A 模型,应该请求 B 模型。
比如我的某个提供商有两个密钥 K1 和 K2
各自的提供商模型是 K1 {A, B}, K2 {B},启用了自动获取模型,但是其中 K1 禁止了 A。
如果我配置了客户端模型 A 可以路由到提供商模型 A 和 B。
但是实际上会向 K1 请求 A 模型,于是乎成功后不会请求 B 模型。
如果是先向 K2 请求,也会尝试先请求 A 模型,然后上游会返回无该模型的失败信息,然后就会转到 K1 请求 A 模型。
预期效果:
如果是向 K1 请求 A 模型,应该路由到 B 模型。
如果是向 K2 请求 A 模型,应该请求 B 模型。