结论
- 401 通常是配置或权限不匹配,不代表 Qwen 服务不可用。
- endpoint 和模型名应以当前官方 DashScope compatible-mode 文档为准。
- 确认 SDK 没有静默使用默认 OpenAI endpoint。
- 生产环境应准备 DeepSeek/GLM 或 routed endpoint,应对 Qwen 鉴权或 quota 失败。
怎么做
- 确认 API key 属于正确阿里云/DashScope 账号和项目。
- 从官方文档复制当前 OpenAI-compatible base_url 和 model name。
- 在 SDK 或工具里显式设置 base_url、api_key、model 和 Authorization 格式。
- 跑最小 chat 请求,检查状态码、响应体和实际请求 host。
- 把可用配置放入服务端 secrets,并在生产流量前加入 fallback 路由。
推荐路径对比
| 平台 | 免费/额度 | 适合 |
|---|---|---|
| 通义千问 DashScope | 注册额度变化 | 主兼容模式设置 |
| DeepSeek | 核验当前价格 | Qwen quota/auth 受阻时的低价 fallback |
| 智谱 GLM | 注册 tokens 变化 | 国产兼容 fallback |
| OpenAI-compatible 清单 | 免费指南 | baseURL 替换校验 |
| OpenLLMAPI | 体验额度变化 | 统一 endpoint、fallback 和路线日志 |
自有平台承接
上线前让 Qwen 配置可观测
smoke test 阶段直连 Qwen;生产应用用一个兼容 route 加请求日志、fallback 和预算控制。
FAQ
Qwen 为什么返回 401?
常见原因是 key 错、账号/项目错、compatible base_url 错、模型权限未开、key 过期或 Authorization header 不匹配。
为什么 OpenAI SDK 还是失败?
有些 client 没显式传 base_url/baseURL 时会用默认 OpenAI 设置。记录 request host 来确认。
模型名会导致像鉴权一样的错误吗?
会。过期或未授权模型可能表现为 access 问题。先用文档中当前可用模型测试。
应该用网关吗?
排错时先直连 Qwen。多个 app 需要共享 key、日志、fallback 或快速切 DeepSeek/GLM 时,用网关。