跳转到内容

千问 Qwen 模型报错或截断 - CC Switch

Quick fix

升级到 CC Switch v3.16.4 并使用对应 Qwen/OpenCode Go 新预设。

报错原文
Range of max_tokens should be [1, 8192]

该集群包含千问/Qwen 相关接入问题的多个变体:1) 早期千问请求端口变化导致 404 或参数错误;2) Nvidia 等严格 OpenAI 兼容后端因转换后存在多个 system message 而拒绝请求;3) OpenCode Go 的 /v1/messages 端点不可用,导致 Claude Code 无限重试,而 /v1/chat/completions 可用;4) Codex 使用千问时经过 Responses→Chat 转换导致流式异常截断;5) qwen-vl-plus 等模型对 max_tokens 有上限限制,Claude Code 初始化请求超过 8192 时报错。维护者在多个 issue 中确认:升级到 v3.16.4 并使用新的供应商预设可解决 Qwen/OpenCode Go/Codex 路由问题;max_tokens 上限限制问题在提供 issue 中尚未有已确认修复。

  1. 升级 CC Switch 到 v3.16.4 或更高版本。

  2. 删除旧的千问、OpenCode Go 或相关手动供应商配置,然后重新选择内置预设。

  3. 如果在 Claude Code 中使用 OpenCode Go,选择新增的 OpenCode Go 预设,使其通过 openai_chat 走 /v1/chat/completions 通道。

  4. 如果在 Codex 中使用千问/百炼,使用 v3.16.4 中切换为原生 OpenAI Responses 接口的 Codex 预设,避免 Responses→Chat 转换导致流式截断。

  5. 如果遇到 qwen-vl-plus 的 max_tokens 超限报错,当前 issue 未提供已确认修复;可先改用不受该限制影响的模型,或等待支持限制 max_tokens 的整流选项。

ToolClaude Code / Codex
Version3.13.0 - 3.16.4
PlatformsWindowsmacOSLinux
为什么不用 CC Switch,直接配置环境变量可以在 Claude Code 中使用千问?
有用户反馈旧版 CC Switch 的千问配置可能因请求端口或转换路径不正确而失败;升级后应重新使用内置预设,而不是沿用旧的手动配置。
OpenCode Go 的 /v1/messages 模型为什么在 Claude Code 中不可用?
维护者说明 v3.16.4 新增 OpenCode Go 预设,通过 openai_chat 转换走可用的 /v1/chat/completions 通道,绕开原生 /v1/messages 端点不可用的问题。
Codex 使用千问为什么会异常截断?
v3.16.3 中 Codex 走千问时会经过 Responses→Chat 路由转换,可能导致流式被异常截断;v3.16.4 已切换为原生 OpenAI Responses 接口。
qwen-vl-plus 报 Range of max_tokens should be [1, 8192] 怎么办?
该问题是由于 Claude Code 初始化请求中的 max_tokens 超过模型上限。当前 issue 中用户请求增加限制 max_tokens 的整流选项,但没有维护者确认已修复。

这是一个非官方社区 wiki,与 cc-switch 作者及项目本身无隶属关系。内容整理自项目公开的 GitHub issues。本站不分发任何软件。