CC Switch v3.20.3
如今主流开源模型的官方 API 大多已原生支持 OpenAI Responses 格式。本版把 Codex 里 Kimi 的两条预设也从 Chat Completions 转换改为原生 Responses 直连——至此 DeepSeek、智谱 GLM、千问、MiniMax、小米 MiMo、LongCat、Kimi 这些主流开源模型的官方 Codex 预设全部直连厂商端点,连同火山豆包与腾讯混元,不再需要开本地路由做格式转换。如果你的 Codex 卡片还是早先添加的 Chat 格式,重新添加一次预设,或在编辑页把「上游格式」改成 Responses,就能直连。其余是一波由贡献者主导的正确性修复:空 reasoning_content 占位符不再让 Claude Code 被空 Thought 块刷屏、Codex 长任务不再在一句进度汇报后戛然而止、Claude Desktop 的模型探针不再在 Responses 上游下误报「不可用」、每次退出都把 Claude 的代理重试与超时抄给 Codex/Gemini/Grok Build 的串写关闭、统一供应商同步不再清空子卡设置;Codex 侧补上省略 model_provider 时的代理路由、Windows 上正在增长的会话用量、托盘里托管账号的额度。预设与定价做了一轮维护:聚合平台目录刷新、千问AI平台改名并升到 Qwen 3.8、MiniMax 默认 M3、DeepSeek V4 家族按 V4.1 Flash 档调价。本版不含数据库迁移。
English → | 日本語版 →
重点内容:你现在可以
- 在 Codex 里直连 Kimi,走原生 Responses:Kimi 开放平台与 Kimi For Coding 两条预设从 openai_chat 改为 openai_responses,Codex 直接连厂商的 /v1/responses,不再需要开本地路由做 Responses→Chat 转换。至此 DeepSeek、智谱 GLM、千问、MiniMax、小米 MiMo、LongCat、Kimi 这些主流开源模型的官方 Codex 预设全部直连;仍只提供 Chat Completions 的端点(百度千帆、腾讯 Token Plan、QwenCloud For Coding、StepFun、百灵、ModelScope 与各聚合平台)继续经本地路由转换。如果你现有的卡片还是早先添加的 Chat 格式(Kimi,以及前几版已切换的 DeepSeek、GLM 等),重新添加一次预设,或在编辑页把「上游格式」改成 Responses,即可直连;详见升级提醒。
- Claude Code 不再被空 Thought 块刷屏(#7227,修复 #5028、#4404):GLM、Qwen、DeepSeek 一类在每个 chunk 里带空 reasoning_content 占位的上游,不再让每个 token 变成一行外加一个空思考块。
- Codex 长任务不再在一句进度汇报后戛然而止(#7280,修复 #6529):经 Chat 上游时,commentary 与紧随的工具调用合并进同一条 assistant 消息,上游不再提前 stop。
- Claude Desktop 在 Responses 上游下不再报「模型不可用」(#7287,修复 #7103):探针的 max_tokens=1 在转换时夹到 Responses API 允许的最小值 16。
- 退出后 Codex、Gemini、Grok Build 的代理重试与超时设置不再被 Claude 的覆盖(#7210,修复 #7204)。
- 同步统一供应商不再清空子卡的用量脚本、通用配置退出与排序(#7212,修复 #7134)。
- 没写 model_provider 的 Codex 卡接管时也走本地代理(#7263,修复 #6256),不再悄悄直连 api.openai.com。
- Windows 上正在增长的 Codex 会话用量不再漏采(#7219,修复 #6060):mtime 不动时也按文件大小判定。
- 托盘显示托管 Codex 卡所绑 ChatGPT 账号的额度(修复 #7267):绑定多个账号时不再只剩名字。
- 看到 Claude Fable 的周限额:供应商卡片与托盘都解析用量 API 新的 limits[] 数组。
- 一键禁用 Claude Code 的 Artifact 工具:DeepSeek 等严格校验工具 schema 的网关不再对每个请求返回 400。
- DeepSeek 官方 Codex 预设能读图(#7286,修复 #7283);deepseek-flash 与 V4 家族按 V4.1 Flash 档记账,不再按 $0 或旧高峰价。
- 一键添加 千问AI平台 Token Plan(#7183);千问AI平台升到 Qwen 3.8、MiniMax 默认 M3(#7255)、聚合平台 Codex 目录刷新。
使用攻略
- 添加供应商:Codex 的原生 Responses 直连与 Chat 路由转换的区别、Claude 快捷开关表(含新增的「禁用 Artifact 工具」),以及「预设改动只影响新建供应商」的含义。
- 请求路由:接管模式下的配置改写与恢复——本版 Codex 缺 model_provider 时的路由修复落在这条路径。
- 用量统计:Codex 会话解析与定价配置,本版的字节游标与定价回填口径。
Warning
唯一官方渠道声明(请务必阅读)
CC Switch 是完全免费、开源的桌面应用,不会向用户收取任何费用。请仅通过下列官方渠道获取本软件:
────────┬────────────────────────────────────
类别 │唯一官方
────────┼────────────────────────────────────
官网 │ccswitch.io
────────┼────────────────────────────────────
源码 │github.com/farion1231/cc-switch
────────┼────────────────────────────────────
下载 │GitHub Releases
────────┼────────────────────────────────────
作者 │@farion1231
────────┼────────────────────────────────────
举报山寨│GitHub Issues
────────┴────────────────────────────────────
任何向你收费、要求充值、或索取登录凭据的"CC Switch"网站或客户端均为假冒。如果你被诱导支付了费用,请立即停止操作并通过 GitHub Issues 反馈。
概览
主流开源模型的官方 API 如今大多已原生提供 OpenAI Responses 端点,Codex 也早已以 Responses 为唯一原生协议。此前 CC Switch 对这些模型的 Codex 预设分两种形态:厂商端点原生支持 Responses 的直连,只提供 Chat Completions 的则由本地代理把 Codex 的 Responses 请求转换成 Chat、再把流式响应转换回来。转换路径能用,但多一层翻译就多一处出错的地方——本版修的 #7280 正是这类转换缺陷。Kimi 开放平台与 Kimi For Coding 的端点现在都原生提供 /v1/responses,官方 Codex 接入指南也要求 wire_api = "responses",于是这两条预设改为原生 Responses 直连。至此 DeepSeek、智谱 GLM、千问(千问AI平台 / QwenCloud)、MiniMax、小米 MiMo、LongCat、Kimi 这些主流开源模型的官方 Codex 预设全部直连厂商端点,连同火山豆包与腾讯混元;仍只提供 Chat Completions 的端点(百度千帆、腾讯 Token Plan、QwenCloud For Coding、StepFun、百灵、ModelScope 与各聚合平台)继续经本地路由转换,手册的「仅 Chat」示例也改为点名这些供应商。
其余是一波由贡献者主导的正确性修复,关闭了几个挂了数月的 issue。代理侧:在每个 chunk 里保留空 reasoning_content 占位的 OpenAI 兼容上游不再让 Claude Code 被空 Thought 块刷屏、逐 token 换行;Codex Responses→Chat 转换器不再把 commentary 消息与紧随的工具调用拆成两条 assistant 消息——这曾让长任务在一句进度汇报后就结束;Claude Desktop 的一 token 模型探针夹到 Responses API 的最小值,映射模型不再被报为「不可用」;Codex 路由下的图片生成补上贴完整端点、大小写后缀与流式用量三处。两个数据完整性问题关闭:每次正常退出都把 Claude 的重试与超时设置抄到 Codex、Gemini、Grok Build 的代理行;同步统一供应商会清空子卡的用量脚本、通用配置退出与端点自动选择,并把卡片挤到列表底部。Codex 侧:卡片省略 model_provider 时接管现在尊重代理地址;用量导入经持久化的字节游标在 Windows NTFS 上识别正在增长的 rollout;托盘为托管 Codex 卡显示所绑 ChatGPT 账号的额度;Claude Fable 的周限额出现在卡片与托盘。Claude 供应商编辑器新增「禁用 Artifact 工具」快捷开关,给拒收 Claude Code Artifact 工具 schema 的网关用。
预设侧:聚合平台 Codex 预设刷新到当前目录,DashScope/百炼改名千问AI平台并升到 Qwen 3.8(#7183),MiniMax 默认改到 M3(#7255),内置 DeepSeek Codex 目录镜像支持视觉的 deepseek-flash(#7286),DeepSeek V4 家族按 V4.1 Flash 档调价。本版不改数据库 schema。
发布日期:2026-09-11
更新规模:22 commits | 62 files changed | +3,458 / -802 lines
新功能
Claude 供应商编辑器新增「禁用 Artifact 工具」快捷开关
部分第三方 Anthropic 兼容网关(DeepSeek 在列)用严格的正则校验器检查工具 JSON Schema,拒收 Claude Code 的 Artifact 工具在其 str_replace 数据库能力铺开后发出的 Unicode 属性转义(\p{Cc}、\p{Cf} 等)——此后每个请求都 400 Invalid schema for function 'Artifact',与所选模型无关。Claude 快捷开关旁新增第六个复选框,在供应商上设置 env.CLAUDE_CODE_DISABLE_ARTIFACT="1",把 Artifact 工具整个排除出 tools 数组;取消勾选时像其他开关一样删掉该键。四语文案与手册(zh/en/ja)的开关表已同步。
Claude Fable 的周限额出现在供应商卡片与托盘
Claude OAuth 用量 API 现在把按模型的周限额放在顶层 limits[] 数组里(kind: "weekly_scoped",带 scope.model.display_name 与 percent),不再是独立的顶层窗口;解析器只读旧窗口,Fable 的限额从未显示过。limits[] 现在解析进 seven_day_fable、seven_day_opus 与 seven_day_sonnet——scoped 行覆盖同名旧窗口,重复与畸形行跳过,旧窗口、额外用量与未知窗口都保留。托盘给 Fable 单独一组标签,不再并进周 max 值;四语补「Fable」标签。
新增预设
千问AI平台 Token Plan(#7183)加入 Claude Code、Claude Desktop、Codex、Hermes、OpenClaw、OpenCode 与 Pi 七个应用的预设库,与下文的改名同批。存量供应商不受影响。
deepseek-flash 与 deepseek-v4-flash-vision-exp 的定价行
deepseek-flash 是 DeepSeek 目前唯一推荐的 id,deepseek-v4-flash-vision-exp 是官方安装脚本 1.2.0 之前写入的旧视觉名;两者都由 V4.1 Flash 服务,按其 $0.30/$1.20 每百万、缓存读 $0.006 计费。此前两者都没有行,而 LIKE '{id}-%' 的前缀回退只匹配更长的 id,这两个 id 下的请求一律按 $0 入账。
变更
Kimi 的 Codex 预设改为原生 Responses 直连
Kimi 开放平台(api.moonshot.cn/v1)与 Kimi For Coding(api.kimi.com/coding/v1)现在都原生提供 /v1/responses,官方 Codex 接入指南要求 wire_api = "responses",于是两条预设从 openai_chat(本地代理做 Responses→Chat 转换、必须开路由接管)改为 openai_responses(Codex 直连)。两个端点都用真实密钥按 Codex 0.153.4 的完整请求形态实测(reasoning.encrypted_content、reasoning.summary、托管 web_search、回放的 reasoning 项),并用 codex exec 跑通端到端工具循环。kimi-k3 成为开放平台的默认模型与目录首行,kimi-k2.7-code 保留为第二行;只对 Chat 转换有意义的 codexChatReasoning 从两条预设移除,Kimi For Coding 的 promptCacheRouting 也去掉——原生路径上 Codex 自己发 prompt_cache_key;每个 Kimi 行声明 supportsParallelToolCalls,与官方 Kimi Code models.json 一致;不声明 reasoning 默认值,因为 config.toml 的 model_reasoning_effort 优先于目录默认值,后者只标记 /model 选择器。手册(zh/en/ja)的「仅 Chat」示例改为点名仍走 Chat 路由的供应商,「Kimi Code 拒收 codex-cli user agent」的过时说明已纠正。无后端改动。
聚合平台的 Codex 预设刷新到当前目录
SiliconFlow(.cn)默认改为 deepseek-ai/DeepSeek-V4-Flash(1M 窗口,high/max 档,显式的 enable_thinking/reasoning_effort 约定),因为国内站的 MiniMax M2.5 已下线;Atlas Cloud 改为 zai-org/glm-5.2,其 Coding Plan 包含的最新 GLM(1M 窗口);Novita 改为 zai-org/glm-5.3(1M,纯文本);NVIDIA NIM 改为 moonshotai/kimi-k3(1M,文本+图片;NIM 接受 reasoning_effort 的 low/high/max、字段缺省时按 max,预设显式钉 high 与其 config.toml 一致);OpenCode Go 的 GLM/Kimi 条目更新——glm-5.3(新默认)、glm-5.3-flash 与 kimi-k3 替换 glm-5.2、glm-5.1 与 kimi-k2.7-code,窗口、模态与档位按 models.dev 镜像,DeepSeek V4 Pro/Flash 与 MiMo V2.5 Pro 行保留。平台未文档化新模型思考/档位约定的(Atlas Cloud、Novita),预设带一条显式的空覆盖,后端不再按模型名注入厂商原生思考字段。
DashScope/百炼预设改名千问AI平台并升到 Qwen 3.8(#7183)
国内百炼预设改名千问AI平台,配专属图标,控制台与 API Key 链接改到 platform.qianwenai.com;Qwen 系列在 Claude Code、Claude Desktop、Codex、Hermes、OpenClaw、OpenCode 与 Pi 七处升到 3.8 代——Opus/Sonnet/Haiku 角色对应 qwen3.8-max / qwen3.7-plus / qwen3.8-flash,统一使用官方的 983,616 token 窗口;国内 Bailian For Coding 预设(Claude Code、Claude Desktop、Hermes)改名 千问AI平台 Coding Plan,端点不变;OpenClaw/OpenCode/Pi 的模型元数据对齐官方客户端文档。国际 QwenCloud 预设保留名称、换专属图标;按量付费预设升到 Qwen 3.8,Token Plan 预设与之对齐(Codex 与 Hermes 本已带 3.8 行),QwenCloud For Coding 保留 qwen3.7-plus、qwen3-coder-plus 与 coding-intl 端点。端点只有一处例外:Pi 的 QwenCloud Token Plan 从 /apps/anthropic(Anthropic Messages)切到 /compatible-mode/v1(OpenAI Chat Completions),Hermes 与 OpenClaw 的 Token Plan 仍在 Anthropic 地址。
MiniMax 预设默认 M3、清掉过期优惠(#7255,修复 #7254)
官方 MiniMax 与 MiniMax (en) 预设在七套预设文件里都默认 MiniMax-M3——Claude Code 声明 1M 上下文(MiniMax-M3[1M] 配官方的 CLAUDE_CODE_AUTO_COMPACT_WINDOW=1000000),Claude Desktop 启用 1M 支持,OpenClaw/OpenCode/Pi 元数据带 1,000,000 token 上下文、131,072 token 输出预算、图片输入与推理支持。过期的 Coding Plan 促销从所有预设与四语文案移除。存量配置与第三方默认值不变。
DouBaoSeed 预设改名火山豆包
七个应用预设文件里的显示名本地化:zh/zh-TW 为「火山 豆包AI」,en/ja 为「Volcengine Doubao」,沿用七牛/Compshare 的惯例——顶层名保留拉丁字母回退,中英文都能搜到。OpenCode 与 Pi 写进客户端配置文件的 settingsConfig.name 同步改名但保持 ASCII 形式(Volcengine Doubao)。Live 配置里的标识符刻意不动:Codex TOML 的 provider 名、Hermes 节点键 doubao_seed、Pi 的 provider 键、OpenClaw 的模型引用前缀、推广键与图标。
DeepSeek V4 家族按 V4.1 Flash 档调价
DeepSeek 已下线 V4 Flash,并宣布 2026-09-14 12:00(北京时间)起 V4 Pro 请求路由到 V4.1 Flash、按 Flash 价计费;本版提前执行这次回调。deepseek-v4-flash、deepseek-v4-flash-0731 与 deepseek-v4-pro 改为 $0.30/$1.20、缓存读 $0.006,修复条目只纠正仍是上一档高峰值的行,并链在 2026-08-16 的峰谷行之后,旧数据库会逐档跳到位。deepseek-chat 与 deepseek-reasoner 没有权威来源,保持不动。deepseek-v4-pro 同时退出纯文本确认表——它现在落在支持视觉的模型上,图片清洗对它 fail-open。
Claude「应用到所有角色」按表单顺序取值
把一个模型名一键抄到 Claude 模型映射所有角色的按钮,此前先取 ANTHROPIC_MODEL;现在按面板从上到下(Sonnet、Opus、Fable、Haiku、子智能体)读取,默认模型只作最后回退。
Atlas Cloud 不再是赞助商
赞助商身份从 README 四语赞助表、横幅、isPartner/partnerPromotionKey 标记与推广文案中移除;七个应用的预设本身保留,从赞助组移到非赞助组,端点、模型与图标不变。
修复
空 reasoning_content 占位符不再让 Claude Code 被空 Thought 块刷屏
部分 OpenAI 兼容上游(GLM、Qwen、经 ModelScope/DashScope 的 DeepSeek-V4-Pro、百炼、京东云……)在每个内容 chunk 里保留 reasoning_content: "" 占位,而不是省略字段。OpenAI Chat→Anthropic SSE 转换器的 reasoning 分支只判断字段是否存在,又与内容分支共享「当前打开块」的状态,于是每个内容 chunk 都先关掉打开的文本块、开一个空 thinking 块、再重开文本块——N 个内容 chunk 变成 2N 个内容块,一半是空 thinking 块,Claude Code 渲染成每个 token 一行、外加几十个空 Thought 块,会话 JSONL 也随之膨胀。空 reasoning 现在在进入分支前就被过滤,与内容分支和非流式转换器已有的守卫一致;两条回归测试钉住占位形态与真实推理两种情况下的块索引、类型与顺序。(#7227,修复 #5028、#4404;取代 #4869、#6421、#6576)
Codex 长任务不再在一句进度汇报后停在 Chat 上游
Codex Responses→Chat Completions 转换器在同一模型回合里遇到 commentary 消息紧跟 function_call 项时,输出两条连续的 assistant 消息;Chat 上游把只有文本的那条当作完整回合,在预期的工具调用之前就返回 finish_reason=stop。待处理的工具调用现在合并进紧邻的、尚无 tool_calls 的 assistant 消息,待处理的 reasoning 按段附加以免并行调用重复,其他边界形态(user/tool 边界、上一批工具调用、媒体刷出)仍走新消息路径;合并后没有 reasoning 的调用仍做占位回填。(#7280,修复 #6529;取代 #6530、#5895;#5860 同报)
Claude Desktop 的模型探针在 Responses 上游下不再失败