2026年7月31日,DeepSeek官方正式发布了V4-Flash正式版。从公开的跑分数据来看,该版本不仅显著优于自家的DeepSeek-V4-Pro预览版,也超越了GLM-5.2。不过,基准测试的分数仅作参考,实际性能仍需通过多场景实测来验证。

ds4d8bbe87a7.jpg

但Deepseek-V4-Flash价格是真的便宜,而且速度也很快,目前除了Deepseek官方对接渠道外,七牛云也率先支持了Deepseek-V4-Flash正式版,新用户注册即送300万Token,有需要的可领取。

领取七牛云300万Token


> 七牛云300万Token领取地址:https://s.qiniu.com/ZjmEji

或扫码领取

七牛 AI 推理邀请海报.png

使用七牛云Deepseek-V4-Flash大模型


注册并认证后在七牛云后台:https://portal.qiniu.com/ai-inference/api-key 创建并复制KEY

CleanShot 2026-08-01 at 11.50.59@2x.png

然后在工具中自定义API端点,同时兼容OpenAI和Anthropic两种格式,对应端点地址为:

* OpenAI BaseURL:https://api.qnaigc.com/v1,完整地址为https://api.qnaigc.com/v1/chat/completions
* Anthropic BaseURL:https://api.qnaigc.com,完整地址为https://api.qnaigc.com/v1/messages

> 备注:Deepseek V4 Flash正式版完整模型ID为deepseek/deepseek-v4-flash-20260731

xiaoz将deepseek/deepseek-v4-flash-20260731正式版接入Cherry Studio进行测试,速度是真的快,能达到170 tokens/s

CleanShot 2026-08-01 at 11.55.00@2x.png

另外七牛云除了提供Deepseek模型外也提供GLM、Kimi、Minimax等模型可供调用。

CleanShot 2026-08-01 at 11.59.08@2x.png

结语


DeepSeek V4-Flash正式版跑分亮眼,实测速度达170 tokens/s,且定价亲民。七牛云率先接入并提供300万Token免费额度,兼容主流API格式,大幅降低开发者试用门槛。尽管实际性能尚需多场景验证,但其高性价比与便捷接入已为AI应用落地提供新选择,值得关注尝试。

> 七牛云300万Token领取地址:https://s.qiniu.com/ZjmEji