DeepSeek V4.1 Flash发布,V4 Pro即将下线

今天,DeepSeek宣布推出DeepSeek V4.1 Flash,并对现有产品及服务进行调整。据官方透露,经内部及外部多方测试,DeepSeek V4.1 Flash在性能、费用、速度及任务总用时等指标上,均已超越DeepSeek V4 Pro。同时,DeepSeek还将原有快速模式、专家模式和识图模式合并为统一的智能模式,模型可根据任务复杂程度自动调整处理能力。

DeepSeek发布V4.1-Flash,V4-Pro将于14日下线

据了解,DeepSeek V4.1 Flash是DeepSeek全新模型结构系列中尺寸最小的模型,参数规模为552B,采用MoE架构和全新的Causal-Encoder-Decoder结构,其输入激活参数为8B、输出激活参数则是16B。

DeepSeek发布V4.1-Flash,V4-Pro将于14日下线

该模型支持原生多模态视觉理解,并采用了新的预训练方式以及更大规模的强化学习后训练。缓存方面,DeepSeek V4.1 Flash大幅缩减了KV Cache缓存大小,相较上一代模型对HBM的需求减少至1/4,对SSD的需求降低至1/8。


DeepSeek此次更新,还涉及DeepSeek V4 Pro。据官方透露,DeepSeek V4 Pro将于9月14日12时正式下线,届时现有的V4 Pro服务将自动路由至V4.1 Flash,并按后者的标准计费,但在V4 Pro下线前,其价格保持不变。

DeepSeek发布V4.1-Flash,V4-Pro将于14日下线

价格方面,DeepSeek V4.1 Flash的价格已于9月10日12时生效,其空闲时段每百万Tokens输入缓存命中、缓存未命中及输出的价格分别为0.02元、1元和4元,高峰时段分别是0.04元、2元和8元。


近期,DeepSeek方面持续更新V4系列模型及API服务。此前在7月31日,DeepSeek V4 Flash正式版API上线公测,其Agent能力得到增强,并支持Responses API与Codex接入。8月13日,DeepSeek V4 Pro正式版发布,新增可调节的推理强度,同时支持OpenAI Responses API。

DeepSeek发布V4.1-Flash,V4-Pro将于14日下线

8月17日,DeepSeek宣布实施峰谷定价机制,并大幅上调API调用价格。其中,北京时间9:00-12:00和14:00-18:00为高峰时段,其余为低谷时段,价格为高峰期的一半。不久后在8月23日,DeepSeek方面宣布周六与周日全天统一按低谷时段收费。


【本文图片来自网络】

踩(0)

最新文章

相关文章

大家都在看