DeepSeek V4 正式发布:百万上下文开源模型,Agent 能力全面升级
DeepSeek released V4 preview on April 24, 2026, with V4-Pro (1.6T total, 49B active) and V4-Flash (284B total, 13B active). Both support 1M token context. V4-Pro achieves SOTA on Agent Coding benchmarks among open-source models, priced at $1.74/M input tokens. Weights open-sourced on Hugging Face.
DeepSeek V4 正式发布:百万上下文开源模型,Agent 能力全面升级
DeepSeek released V4 preview on April 24, 2026, with two models — V4-Pro (1.6T total, 49B active) and V4-Flash (284B total, 13B active). Both models support 1M token context window, a first for an open-weight model at this scale. V4-Pro is immediately available via API at $1.74/M tokens input, with the model weights open-sourced on Hugging Face. The announcement garnered 1,092 points and 736 comments on Hacker News within hours, making it one of the most discussed AI releases of 2026.
背景与触发事件
| 字段 | 内容 |
|---|---|
| 时间 | 2026-04-24 03:01 UTC |
| 地点/渠道 | DeepSeek 官方微信公众号 / Hugging Face / HN |
| 主要参与者 | DeepSeek (深度求索) |
事件要点:
- V4-Pro 在 Agent Coding 基准上达到开源模型 SOTA,官方声称优于 Claude Opus 4.6 Max
- V4-Flash 作为经济型选项,推理成本更低且长上下文效率优于 Pro
- 引入 DSA(Deeply Sparse Attention)架构,将百万级上下文推理成本控制在与短上下文持平的水平
- 模型权重已在 Hugging Face 开源,API 即日可用
关键影响
技术影响表:
| 维度 | 影响内容 |
|---|---|
| 技术性能 | 1M token 上下文窗口,DSA 注意力架构实现线性推理成本 |
| 生态集成 | 已适配 vLLM、Claude Code、OpenClaw、OpenCode、CodeBuddy 等 Agent 框架 |
| 开发者体验 | 新增 reasoning_effort 参数(低/高/最高),max 模式面向 Agent 任务优化 |
| 定价影响 | V4-Pro: $1.74/$3.48 每 M 输入/输出 tokens;V4-Flash: $0.14/$0.28(Flash 价格仅为 V3 的约 1/3) |
行业影响表:
| 方面 | 可能变化 |
|---|---|
| 竞争格局 | 开源模型首次在 Agent 编码场景追平闭源旗舰(Opus 4.6),对 OpenAI、Anthropic 形成直接压力 |
| 市场趋势 | 百万上下文成为新标配,DSA 架构可能影响下一代 Transformer 设计方向 |
| 开发者需求 | 基于开源长上下文模型的自部署 Agent 方案将显著增加,降低对 API 依赖 |
适配建议
对开发者:
- V4-Pro 是 Agent/编码工作流的首选推荐,Flash 不推荐用于复杂 Agent 任务
- API 已上线,可通过 reasoning_effort 参数控制思考强度
- 开源权重可部署在 Atlas Cloud,自托管方案可对比 vLLM 的性能优化
对使用者:
- DeepSeek 网页端和 APP 已同步更新至 V4 系列
- 1M 上下文适合处理长文档分析、代码库级推理、多轮对话等场景
值得关注的点:
- DSA(Deeply Sparse Attention)架构的技术细节和实际推理速度表现
- 开源社区对 Agent 能力的验证和第三方基准测试结果
- OpenClaw、Claude Code 等 Agent 工具的实测对比
行业反应
开发者社区:
- Hacker News 上 DeepSeek V4 帖子在数小时内获得 1,092 points 和 736 条评论,成为当日最热门讨论
- 开发者普遍关注 1M 上下文的实际可用性和 DSA 架构的性能表现
- 社区对 V4-Flash 的定价($0.14/M tokens)反应热烈,认为将大幅降低 Agent 应用的门槛
竞争对手:
- OpenAI 和 Anthropic 尚未对 DeepSeek V4 的发布发表公开回应
- 此前仅一周(4月17日),Anthropic 刚发布了 Claude Design,4月16日推出了 Claude Opus 4.7
分析师观点:
"The 1M context is the real headline. V4 inference cost stays flat as tokens scale up vs V3.2 which shoots up. The architecture improvement is what makes this actually usable, not just a spec number." — HN 社区讨论
工具词条嵌入
本文在技术细节和行业分析中自然引用了以下工具词条(≥3个要求):
- Anthropic — 竞争格局分析中引用
- OpenAI — 竞争对手回应中提及
- Claude Code — 生态集成与 Agent 适配中提及
- OpenClaw — DeepSeek 官方公告中提及的适配 Agent 产品
- vLLM — 技术适配和推理优化中提及
主题中心
2026 AI 编程工具全景指南
从 Copilot 改版到 Claude Code / DeepSeek 低成本方案——把分散资讯收成可搜索、可对比的工具矩阵。
进入「2026 AI 编程工具全景指南」 →赚钱视角
这个趋势怎么赚钱?
WayToClawEarn 的差异在可验证的赚钱案例,而不只是资讯。从这些复盘开始:
浏览全部案例 →