深度求索发布新AI模型 支持百万词元上下文
深度求索(DeepSeek)星期五(4月24日)发布DeepSeek-V4系列预览版,同时开源模型权重。该公司一年多前曾以低成本推理模型震惊业界,其能力与美国的竞争对手相当。
V4系列包含Pro与Flash两个版本。Pro版本总参数1.6万亿,激活参数490亿;Flash版本总参数2840亿,激活参数130亿。两个版本均原生支持百万token上下文长度。
效率与架构提升
深度求索称,V4系列已将百万上下文从“高端功能”转化为基础服务。自发布日起,百万token上下文成为所有官方服务的标配。
在百万token上下文设置下,V4-Pro的单token推理FLOPs仅为前代V3.2的27%,KV缓存仅为前代的10%;V4-Flash将两项指标分别压缩至10%和7%。
模型采用混合注意力架构,结合压缩稀疏注意力与重度压缩注意力。同时引入流形约束超连接以强化残差连接。
基准测试与硬件规划
官方数据显示,在世界知识基准测试中,V4-Pro大幅领先其他开源模型,仅略逊于谷歌Gemini-Pro-3.1。在数学、STEM、竞赛代码测评中,V4-Pro超越所有已公开评测的开源模型,取得比肩顶级闭源模型的成绩。
在MMLU-Pro编码基准测试中,V4-Pro表现与OpenAI GPT-5.4相当,但略逊于谷歌Gemini-3.1-Pro和Anthropic Claude Opus 4.6。深度求索在报告中表示,V4的整体能力水平仍落后GPT-5.4和Gemini-3.1-Pro,“发展轨迹大约滞后前沿闭源模型3至6个月”。
公司确认,V4系列模型在下半年将支持华为算力。深度求索表示其系统包含兼容英伟达和华为芯片的软件组件,但未披露V4模型训练所用的确切硬件。
API服务已同步上线。开发者将model参数修改为deepseek-v4-pro或deepseek-v4-flash即可调用,接口兼容OpenAI ChatCompletions与Anthropic两套标准。













