2026/10/11 13:34:46

旧模型 7 月 24 日就退役了,还在用 deepseek-chat 调 API 的人踩了哪些坑

旧模型 7 月 24 日就退役了,还在用 deepseek-chat 调 API 的人踩了哪些坑 旧模型 7 月 24 日就退役了还在用 deepseek-chat 调 API 的人踩了哪些坑【免费下载链接】DeepSeek-V4-Flash-0731项目地址: https://ai.gitcode.com/hf_mirrors/deepseek-ai/DeepSeek-V4-Flash-07312026 年 4 月 24 日DeepSeek 正式发布 V4 系列大模型并同步更新 API 定价体系官方公众号以《DeepSeek-V4 预览版迈入百万上下文普惠时代》宣告了新一代模型体系的到来。几乎同时官方给出了明确的时间表旧模型名deepseek-chat与deepseek-reasoner于2026 年 7 月 24 日退役。三个月后回看这个退役日成了不少开发者事故的分水岭——那些把deepseek-chat写死在代码、配置文件、CI 脚本里的项目在 7 月 24 日零点过后陆续收到404与Model Not Exist。本文结合社区一线排障记录与本仓库DeepSeek-V4-Flash-0731 官方权重与推理代码源码把这次模型名迁移中踩过的坑、正确的迁移姿势与验收/回滚方案完整梳理一遍。一、退役时间线与 404 报错全记录先把关键时间节点对齐时间事件2026-04-24DeepSeek V4 系列发布Pro / Flash 双版本预览版形态API 定价体系同步更新2026-05社区实测确认旧模型 deepseek-chat 与 deepseek-reasoner 将于 7 月 24 日退役2026-07-24旧模型名正式停用2026-07-31DeepSeek-V4-Flash 正式版 API 上线公测即本仓库DeepSeek-V4-Flash-0731退役之后凡是继续以model: deepseek-chat发起请求的客户端都会命中服务端的模型不存在错误。社区排障帖里最典型的两类 404 报文如下模型名整体失效直接沿用deepseek-chat/deepseek-reasoner请求被拒返回Model Not Exist一类的错误新旧混用只把deepseek-chat改成了deepseek-v4或deepseek-v4-flash-preview之类的半新半旧名字同样 404。第二类是重灾区。V4 系列的实际模型 ID 是deepseek-v4-pro与deepseek-v4-flash且允许通过[1m]后缀显式开启百万级上下文如deepseek-v4-pro[1m]、deepseek-v4-flash[1m]。把后缀写在错误位置、漏掉连字符、或把 preview 时期的旧 ID 继续用于生产都会直接踩中 404。值得一提的是7 月 31 日上线的正式版与 4 月的预览版并非简单的版本号变更。本仓库 README.md 明确指出DeepSeek-V4-Flash-0731 是 DeepSeek-V4-Flash 的官方正式版取代预览版Agent 能力大幅增强并给出了一组与预览版、V4-Pro 预览版乃至闭源旗舰的对照数据BenchmarkV4-Flash-0731V4-Flash (Preview)V4-Pro (Preview)Terminal Bench 2.182.761.872.1DeepSWE54.47.312.8Cybergym76.738.752.7NL2Repo54.239.438.5Toolathlon-Verified70.349.755.9也就是说迁移不只是改个名字接着用正式版 Flash 在代码与 Agent 任务上已经反超了 Pro 预览版迁移反而是一次免费的能力升级。这就是为什么值得把这次命名迁移当成一次正式的工程变更来对待。二、settings.json 迁移清单命名、Key、端点逐个核对对于使用 Claude Code、TRAE、cc-switch 等工具接入的开发者配置一般落在~/.claude/settings.jsonWindows 下为当前用户目录的.claude\settings.json。退役之后需要逐项核对三个维度模型命名、认证 Key、接入端点。1. 命名ANTHROPIC_DEFAULT_*_MODELV4 迁移后的标准映射是OPUS与SONNET映射到deepseek-v4-proHAIKU映射到deepseek-v4-flash需要 1M 上下文的场景在模型名后追加[1m]。注意两点配置了ANTHROPIC_DEFAULT_OPUS/SONNET/HAIKU_MODEL之后ANTHROPIC_MODEL是无需再配的——最新版客户端从model字段与三档默认模型读取不会读取这个变量社区普遍建议不要强制设置CLAUDE_CODE_SUBAGENT_MODEL让内置子代理按任务类型在 Haiku/Sonnet/Inherit 之间自行调度否则会把低成本路径全部锁死在单一模型上。2. KeyANTHROPIC_AUTH_TOKEN从环境变量迁移到配置文件时Key 直接填入ANTHROPIC_AUTH_TOKEN值为 DeepSeek 平台创建的 API Key。坑点集中在Key 带空格或换行、多个工具共用同一把 Key 导致限额互相挤占、以及把 Key 提交进 Git 仓库。多项目场景下的 Key 治理见第三节。3. 端点ANTHROPIC_BASE_URLAnthropic 兼容端点固定为https://api.deepseek.com/anthropic。这里有一个隐蔽的坑如果同时保留旧的 OpenAI 兼容端点配置https://api.deepseek.com/v1给其他工具两者请求头格式不同Anthropic 用x-api-key/Authorization: Bearer体系OpenAI 兼容用Authorization混用时容易拿到奇怪的鉴权报错而非明确定位的 404。建议按工具逐个核对端点不要靠环境变量全局生效糊弄过去。一个核对无误的完整示例Linux/macOS 与 Windows 通用文件不存在则自建{ $schema: https://json.schemastore.org/claude-code-settings.json, env: { ANTHROPIC_BASE_URL: https://api.deepseek.com/anthropic, ANTHROPIC_AUTH_TOKEN: 你的 DeepSeek API Key, ANTHROPIC_DEFAULT_OPUS_MODEL: deepseek-v4-pro[1m], ANTHROPIC_DEFAULT_SONNET_MODEL: deepseek-v4-pro[1m], ANTHROPIC_DEFAULT_HAIKU_MODEL: deepseek-v4-flash[1m], CLAUDE_CODE_DISABLE_NONESSENTIAL_TRAFFIC: 1, CLAUDE_CODE_EFFORT_LEVEL: max }, model: opus }CLAUDE_CODE_EFFORT_LEVELmax会被 DeepSeek API 映射为high/max档位的思考强度这一点在本仓库的编码实现中有直接对应encoding/encoding_dsv4.py中reasoning_effort支持low/high/max三档其中max档在提示词头部注入 Reasoning Effort: Beyond maximum 前缀用于 Agent 类长程任务。配置细节可参考 encoding/README.md 中 Reasoning Effort 一节。三、多项目多 Key 场景下的统一命名规范单项目迁移只需改一处配置真正翻车的是多项目、多 Key、多工具并存的开发者。社区里Claude Code 配 TaoToken一类的实操文章反复强调统一模型命名规范是多项目/多 Key 场景下平滑迁移与成本可控的关键。踩坑记录显示混乱通常来自三类来源项目间配置漂移A 项目用deepseek-v4-proB 项目沿用旧名deepseek-chatC 项目写成了deepseek_v4_flash下划线代替连字符退役日后 B、C 一起 404大小写与后缀不统一DeepSeek-V4-Flash与deepseek-v4-flash在部分网关下会被视为不同模型[1m]是否追加也直接影响计费口径1M 上下文与默认上下文是两套价格Key 与模型混绑多把 API Key 分散在.env、settings.json、CI 密钥库中退役后只改了一处线上依然用旧名。可行的统一方案是把模型名抽象为受版本控制的单一事实来源在团队级配置文件或.env.example中定义统一变量如DS_CHAT_MODELdeepseek-v4-flash、DS_PRO_MODELdeepseek-v4-pro各项目引用变量而非硬编码字符串对所有存量项目执行一次全局扫描把deepseek-chat、deepseek-reasoner、deepseek-v4-flash-preview等旧 ID 全部替换为正式 ID并在 CI 中加一道禁用词检查从源头阻止旧名回流为每个项目/工具分配独立 Key 并在命名上带上下文如proj-ai-agent、proj-ci-batch便于退役切换时按项目灰度也便于在平台用量页面对账。四、迁移验收清单与回滚预案改完配置不算完还要验证能通、能跑、能退。下面这份验收清单覆盖了社区高频翻车点1. 命令行连通性验证不依赖 GUI 工具Anthropic 兼容端点curl -s https://api.deepseek.com/anthropic/v1/messages \ -H x-api-key: $DEEPSEEK_API_KEY \ -H anthropic-version: 2023-06-01 \ -H content-type: application/json \ -d {model:deepseek-v4-flash,max_tokens:64,messages:[{role:user,content:ping}]}OpenAI 兼容端点curl -s https://api.deepseek.com/v1/chat/completions \ -H Authorization: Bearer $DEEPSEEK_API_KEY \ -H content-type: application/json \ -d {model:deepseek-v4-flash,messages:[{role:user,content:ping}]}返回正常即证明模型名 Key 端点三者全部正确若仍返回模型不存在类错误优先怀疑模型名拼写与[1m]后缀位置。2. 上下文长度与思考模式核验用deepseek-v4-flash[1m]配置后在 Claude Code 中执行/context确认上下文上限已从默认档切到 1M 档确认思考模式开关符合预期。V4 系列在编码层面区分chat与thinking两种模式并支持drop_thinking参数无工具调用时历史轮次的思考内容会被剥离仅保留最后一轮thinking块一旦引入工具调用system/developer消息带tools字段drop_thinking自动关闭全部轮次保留推理上下文。这解释了为什么同样的提示词在纯对话与 Agent 场景下 token 消耗差异巨大——详见 encoding/README.md 的 Interleaved Thinking Mode 一节。3. 成本与用量监控迁移后首周建议在平台用量页对账V4-Flash 的缓存命中输入价约 0.02 元/百万 token、未命中输入约 1 元、输出约 2 元V4-Pro 输出约 6 元。Agent 任务 token 消耗远超普通对话若迁移前后成本出现数量级变化先检查是否意外把高频路径路由到了 Pro以及思考内容是否被按输出 token 计费。4. 回滚预案旧模型已于 7 月 24 日退役不存在真正意义上的回滚到旧名——这一点必须在预案里讲清楚防止团队在事故发生时误以为改回deepseek-chat即可恢复。合理的回滚是模型级别的降级迁移前为每个项目保存一份settings.json/ 环境变量快照含旧 Key 与端点便于审计而非回退采用影子流量灰度先让 10% 流量走deepseek-v4-flash观察一周错误率、延迟、成本稳定后再全量切换兜底路径若正式版 Flash 在特定场景表现不达预期可降级路由到deepseek-v4-pro同一命名体系内降级而非回退旧名在监控大盘上为模型不存在类错误单独建告警退役切换期一旦出现即触发人工介入。最后补一句硬事实本次迁移并非旧模型退役、新模型上位这么简单——正式版 Flash 的 Agent 能力已经超越 Pro 预览版见本文第一节表格且 config.json 中max_position_embeddings: 1048576意味着这个轻量模型原生支持百万 token 上下文。把deepseek-chat从代码里彻底删除换来的不仅是一次不再 404而是更便宜、更快、更强的推理链路。迁移清单、命名规范、验收与回滚预案都齐了剩下的就是动手扫一遍自己的项目。【免费下载链接】DeepSeek-V4-Flash-0731项目地址: https://ai.gitcode.com/hf_mirrors/deepseek-ai/DeepSeek-V4-Flash-0731创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考