DeepSeek V4 Flash 正式上线,完美适配 Codex,Agent 能力大幅提升,超过了 V4 Pro 的 Preview 版本。这次 DeepSeek 终于补上了 Responses API。之前的 V4 预览版已支持 OpenAI Chat Completions 和 Anthropic 接口,这次 V4 Flash 直接支持将 DeepSeek 模型接入 Codex。具体安装方式看这里: https://api-docs.deepseek.com/zh-cn/quick_start/agent_integrations/codex 在 Codex 配置中把模型设为“deepseek-v4-flash”,提供方指向 DeepSeek,通信协议设为“responses”即可。Codex CLI、ChatGPT 桌面端和 VS Code 插件可以共用同一份配置,一次设置覆盖三种入口。官方还提供了一键接入脚本。为啥这次这么照顾 Codex 了?因为 Codex 雄起了呗。今天早上看到消息,OpenAI 的 CFO 和董事会主席介绍了 O 记的营收增长情况及与 Anthropic 的竞争态势,称 7 月年化经常性收入规模超过整个第二季度(第二季度业绩表现并不差)。这个收入增长来自哪?主要是 Codex 的突飞猛进,Codex 已经成为海外用户的头部 Agent 工具,Codex 能否理解指令、返回结构化工具调用,并在多轮操作中保持节奏,给知识工作者和工程师带来了巨大的效率提升,在这个节点上,DeepSeek 为 Codex 增加 Responses API,应该是为了扩大海外用户的使用范围和影响力。兼容不只覆盖请求格式。V4 Flash 支持 developer 指令、函数调用、网页搜索和并行工具调用,还接受 Codex 使用的 apply_patch 自定义工具。流式返回采用带序号的语义事件,Codex 可判断响应是在生成内容、调用工具,还是已经完成等等。尤其,这次 V4 Flash 强化了 Agent 能力。它提供 100 万 token 上下文和 38.4 万 token 输出,支持思考与非思考模式。价格为每百万 token 缓存命中输入 0.02 元、未命中输入 1 元、输出 2 元,均低于 V4 Pro。Agent 反复读代码、写补丁、查日志,低成本会直接延长可用工作时间。墨问的 CatReader 后台接的就是 DeepSeek V4 Flash,真的省钱啊。目前,DeepSeek 的 Responses API 仍采用无状态设计,不支持通过 previous_response_id 或 conversation 续接会话,也不支持存储和后台任务。图片、文件输入尚未开放;作为 Responses API 内置工具传入的 MCP、计算机操作和代码解释器会被忽略。部分不支持的参数会被静默忽略,因此接入顺畅不代表所有能力都已生效。 V4 Pro 暂时还不能通过 Responses API 接入,另外,V4 Pro 的正式版我估计得 8 月份了。

MacTalk 2026-07-31 15:04
推荐阅读