浙江世界杯科技有限公司-赛事数据与体育内容服务平台

DeepSeek-V4-Flash正式API上线倍价格仅为Claude的190

2026-09-15 21:12:58

  

DeepSeek-V4-Flash正式API上线倍价格仅为Claude的190

  【TechWeb】8月1日消息,AI圈又炸了。DeepSeek悄然上线-Flash正式版API,一个“廉价版”模型,却在Agent能力上碾压了三个月前的Pro预览版。更让人震惊的是——它只重新做了后训练,模型骨架一点没变。

  这不是一次普通的版本迭代。一个2840亿参数的MoE模型,激活参数仅130亿,价格低至0.2元/百万tokens(缓存命中),却在多项Agent基准测试中,硬生生把三个月前的V4-Pro预览版摁在地上摩擦。

  DeepSeek-V4-Flash正式版采用MoE架构,总参数量2840亿,激活参数130亿,支持100万token上下文,可切换思考/非思考模式。

  在海外模型评测机构Artificial Analysis的智能指数测试中,V4-Flash-0731(最高推理档位)拿下50分,而同类可比模型的中位数仅为17分。

  DeepSeek官方确认:V4-Flash-0731的模型结构、尺寸与预览版完全一致,仅重新进行了后训练。

  同一个骨架,同一套参数规模,只是后训练的策略更精细了,结果就在Agent基准测试上产生了质的飞跃。

  有开发者分享:“今天正式版出来后,就用官方API接入Claude Code中开始干活,不到4个小时,差不多消耗了1亿token,缓存命中率竟然达到了99%,关键是干活质量还不错,很少返工。”

  另一位用户更直接:“一遍写完,真实测试一遍完美通过,顺手还修了十几个bug……最恐怖的是opencode花了0.1美元。”

  从事Qt/C++上位机、STM嵌入式开发的个人开发者反馈:“flash0731的agent表现与v4-pro-preview的表现非常接近”,“目前初步使用感觉flash在能力上和pro-preview相比没有明显差异,但是人是便宜啊!!!”

  微博上有用户评价:“最近又高强度的使用了DeepSeek V4 Flash,感觉优势貌似又回来了点儿,在代码和Terminal指令这块貌似也提升很大。”

  最大的槽点是仅限API公测。网页端和App都没有更新,普通用户暂时无法体验。“对大众玩家不够友好”是高频反馈。

  指令遵循仍有短板。有开发者指出:“这版本太喜欢框框干了,没说清楚的事情不太适合交给他干,会出错岔子的;很清晰、有边界的任务可以交给他。”

  另外,Agent模式下推理语言被锁定为英文,系统提示词完全无效。GitHub上已有用户提出希望开放语言控制参数。

  嵌入式开发仍有瑕疵。有开发者反馈:“在嵌入式开发表现已经比上半年的许多模型表现好很多了,但是还是会出现端口识别不清、写出连编译都通过不了的代码。”

  一边是国际巨头主动降价,一边是中国厂商用1/90的价格交出更强的Agent能力。

  有评论一针见血:“DeepSeek-V4-Flash正式版的Agent能力全面超越此前的Pro预览版,相当于用更便宜的价格交出了更强的干活能力。这是在证明,低价不等于低能。”

  有业内人士指出,这次升级释放了一个明确的信号,大模型竞赛正在从“堆参数”转向“精调优”。同样的模型骨架,仅靠后训练的优化,就能在Agent能力上实现6倍增长。这对整个行业的启发是深远的,参数的尽头可能不是更大,而是更聪明地训练。