9 月 9 日消息,DeepSeek 将于 9 月 10 日 12:00 起大幅调整 flash 系列模型定价,闲时输入价格从每百万 token 1.5 元降至 1 元,闲时输出价格从 4.5 元降至 4 元,闲时缓存价格从 0.05 元降至 0.02 元;高峰时段价格为闲时价格的 2 倍。

与此同时,DeepSeek V4.1 Flash 中间版本已开放内测。参与内测的 API 用户无需更改 base_url,将模型名切换为「deepseek-v4.1-flash-expires-on-0910」即可调用,当前计费与 DeepSeek V4 Flash 相同,单账号最多支持 20 并发请求。
该模型 ID 中的失效日期为 9 月 10 日,属短期内测版本,尚未替换官网 API 文档中的正式 V4 Flash 型号,新版本采用不同的模型架构,原生支持多模态,本轮测试重点为能力、生成速度和推理成本。