跳到主要内容

新模型2026年9月11日

DeepSeek V4 Flash W8A8 性能升级公告

deepseek/deepseek-v4-flash-w8a8 已完成推理服务升级。

本次升级保持模型名称、调用方式及价格不变,现有接口参数无需修改。升级后,模型推理速度由原约 60 TPS 提升至约 70–100 TPS,响应更快,使用体验更加流畅。

模型价格​

计费项目平台价格
输入 Token¥1.20 / 百万 Token
输出 Token¥3.60 / 百万 Token
缓存命中¥0.04 / 百万 Token

平台赠送积分可用于模型消费。

使用方式​

模型名称和调用方式保持不变,无需修改现有接口参数。登录平台即可体验升级后的模型服务。

备注

实际速度可能因请求长度、上下文规模及实时负载有所变化,具体计费以平台账单为准。