StableLearn Logo

搜索内容

News 9 min read

DeepSeek-V4 发布:1M 上下文标配,Agent 能力超越开源模型,优于 Claude Sonnet 4.5

DeepSeek-V4 正式发布!百万上下文标配,Agent 能力超越开源模型,推理性能比肩 GPT-4o 和 Claude Opus。Pro 版本达到顶级闭源模型水平,Flash 版本更快更经济。全新注意力机制 + DSA 稀疏注意力,计算和显存需求大幅降低

Cover image for DeepSeek-V4 发布:1M 上下文标配,Agent 能力超越开源模型,优于 Claude Sonnet 4.5

本文发布于 148 天前,内容可能已过时,请注意甄别。

2026 年 4 月 24 日,DeepSeek 正式发布全新系列模型 DeepSeek-V4 并同步开源。

核心数据:1M(百万 token)上下文标配,在 Agentic Coding 评测中达到开源模型最佳水平,数学、STEM、竞赛型代码测评超越所有已公开评测的开源模型。

在实际使用中,DeepSeek-V4-Pro 的表现优于 Claude Sonnet 4.5,交付质量接近 Claude Opus 4.6 非思考模式。目前该模型已成为 DeepSeek 公司内部员工使用的主力 Agentic Coding 工具。

从今天开始,1M 上下文成为 DeepSeek 所有官方服务的标准配置。

两大版本:Pro 和 Flash,各有所长

DeepSeek-V4 按大小分为两个版本,满足不同场景需求:

版本定位核心优势适用场景
DeepSeek-V4-Pro旗舰版Agent 能力最强,推理性能顶级,世界知识丰富复杂 Agent 任务、高难度推理、专业知识问答
DeepSeek-V4-Flash经济版推理能力接近 Pro,速度更快,成本更低简单 Agent 任务、日常对话、批量处理

两个版本都标配 1M 上下文,都支持思考模式(Reasoning Mode)。

DeepSeek-V4-Pro:性能比肩顶级闭源模型

1. Agent 能力大幅提升

重点来了:DeepSeek-V4-Pro 的 Agent 能力显著增强。

Agentic Coding 评测表现:

  • 达到当前开源模型最佳水平
  • 使用体验优于 Claude Sonnet 4.5
  • 交付质量接近 Claude Opus 4.6 非思考模式
  • 与 Opus 4.6 思考模式仍有一定差距

数据不会骗人:DeepSeek-V4 已成为 DeepSeek 公司内部员工使用的 Agentic Coding 模型。

Agent 相关评测全面优异:

  • 代码任务表现提升
  • 文档生成任务表现提升
  • 针对 Claude Code、OpenClaw、OpenCode、CodeBuddy 等主流 Agent 产品进行了专项优化

2. 丰富的世界知识

DeepSeek-V4-Pro 在世界知识测评中:

  • 大幅领先其他开源模型
  • 仅稍逊于顶尖闭源模型 Gemini-Pro-3.1

简单说,就是知识储备已经接近 Google 的顶级模型了。

3. 世界顶级推理性能

在数学、STEM、竞赛型代码的测评中,DeepSeek-V4-Pro:

  • 超越当前所有已公开评测的开源模型
  • 取得了比肩世界顶级闭源模型的优异成绩
能力维度DeepSeek-V4-Pro对比
数学推理✅ 超越所有开源模型比肩 GPT-4o、Claude Opus
STEM 推理✅ 超越所有开源模型比肩顶级闭源模型
竞赛型代码✅ 超越所有开源模型比肩顶级闭源模型
世界知识✅ 大幅领先开源模型仅稍逊于 Gemini-Pro-3.1
Agent 能力✅ 开源模型最佳优于 Sonnet 4.5,接近 Opus 4.6

DeepSeek-V4-Flash:更快捷高效的经济之选

DeepSeek-V4-Flash 的定位是速度和成本的平衡:

性能表现:

  • 世界知识储备稍逊于 Pro
  • 推理能力接近 Pro
  • 简单 Agent 任务上与 Pro 旗鼓相当
  • 高难度 Agent 任务上仍有差距

核心优势:

  • 模型参数和激活更小
  • 提供更加快捷、经济的 API 服务
  • 同样支持 1M 上下文和思考模式

简单说,日常使用选 Flash,复杂任务选 Pro。

黑科技:全新注意力机制 + DSA 稀疏注意力

最让人眼前一亮的是 DeepSeek-V4 的结构创新。

核心技术突破

DeepSeek-V4 开创了一种全新的注意力机制:

  • 在 token 维度进行压缩
  • 结合 DSA 稀疏注意力(DeepSeek Sparse Attention)
  • 实现了全球领先的长上下文能力

技术优势:

  • 相比传统方法大幅降低计算需求
  • 相比传统方法大幅降低显存需求
  • 支持 1M 上下文成为标配

性能对比

对比维度DeepSeek-V4传统方法
计算量✅ 大幅降低❌ 随上下文长度线性增长
显存容量✅ 大幅降低❌ 随上下文长度线性增长
上下文长度✅ 1M 标配❌ 通常 32K-128K

从现在开始,1M(一百万)上下文将是 DeepSeek 所有官方服务的标配。

Agent 能力专项优化

DeepSeek-V4 针对主流 Agent 产品进行了适配和优化:

Agent 产品优化内容
Claude Code代码任务、文档生成
OpenClawAgent 框架适配
OpenCode代码生成优化
CodeBuddy编程助手优化

实际应用场景:

  • 代码任务表现提升
  • 文档生成任务表现提升
  • 支持生成 PPT、报告等复杂文档

怎么用?三种方式任你选

1. 在线对话

登录官网 chat.deepseek.com 或官方 App,即可与最新的 DeepSeek-V4 对话,探索 1M 超长上下文记忆的全新体验。

2. API 调用

API 服务已同步更新,支持:

  • OpenAI ChatCompletions 接口
  • Anthropic 接口

调用方法:

   # base_url 不变,只需修改 model_name
model_name = "deepseek-v4-pro"  # 或 "deepseek-v4-flash"

核心参数:

  • 最大上下文长度:1M
  • 支持非思考模式和思考模式
  • 思考模式支持 reasoning_effort 参数设置思考强度(high/max)

使用建议:

  • 复杂 Agent 场景建议使用思考模式
  • 思考强度设置为 max

3. 本地部署

DeepSeek-V4 已同步开源,支持本地部署:

开源链接:

技术报告:

重要提醒:旧接口即将停用

请注意:旧有的 API 接口的两个模型名将于 2026 年 7 月 24 日停止使用:

  • deepseek-chat → 将指向 deepseek-v4-flash 非思考模式
  • deepseek-reasoner → 将指向 deepseek-v4-flash 思考模式

建议尽快迁移到新的模型名。

能干啥?场景多到数不过来

应用场景核心能力实际价值
Agentic Coding代码生成、调试、重构提升开发效率,代码质量接近人类专家
文档生成PPT、报告、技术文档自动化内容创作,节省大量时间
长文本分析1M 上下文理解分析整本书、完整代码库、长篇论文
复杂推理数学、STEM、竞赛代码解决高难度问题,辅助科研和学习
知识问答丰富的世界知识专业领域咨询,知识检索
思考模式深度推理处理复杂逻辑,提供详细思考过程

写在最后

DeepSeek-V4 的发布,标志着百万上下文普惠时代正式到来。

不再是「有个长上下文」就叫长上下文模型,而是要做到:1M 上下文标配 + 顶级推理能力 + 强大 Agent 能力 + 全面开源。

更重要的是,DeepSeek 这次不仅放出了模型,还提供了完整的 API 服务和开源权重。开发者可以直接上手,不用等。

从 Agent 能力来看,DeepSeek-V4-Pro 已经达到了优于 Claude Sonnet 4.5,接近 Opus 4.6 非思考模式的水平。这意味着,开源模型在 Agent 领域已经可以和顶级闭源模型掰手腕了。

从技术创新来看,全新的注意力机制 + DSA 稀疏注意力,让 1M 上下文不再是奢侈品,而是标配。计算和显存需求的大幅降低,意味着更多开发者可以用上超长上下文能力。

AGI 的未来,可能比我们想象的来得更快。

分享文章

更多文章