📌 事件概述

2026 年 4 月 24 日,DeepSeek 正式发布并开源其新一代旗舰模型 DeepSeek-V4 Preview。这是继 2025 年 1 月 R1 推理模型引发全球软型市动荡以来,DeepSeek 的又一次重磅发布。

本次发布采用“轻量发布,重点开源”的方式,没有冗长的发布会,只在官网和 GitHub 更新了关键信息。全系列标配多项能力,提供 Pro 和 Flash 两个版本。

🔧 核心技术参数

  • DeepSeek-V4-Pro:1.6T 总参数 / 49B 激活参数,MoE 架构
  • DeepSeek-V4-Flash:284B 总参数 / 13B 激活参数,轻量高效
  • 超长上下文:1M context 成为全系列标配
  • 双模式支持:Thinking / Non-Thinking

V4-Pro 能力

  • 增强 Agent 能力:开源 SOTA 的 Agentic Coding 基准表现
  • 丰富世界知识:领先所有开源模型,仅欥于 Gemini-3.1-Pro
  • 世界级推理:在 Math/STEM/Coding 中击败所有开源模型,匹敍顶级闭源模型

V4-Flash 能力

  • 推理能力接近 V4-Pro
  • 简单 Agent 任务上与 V4-Pro 持平
  • 更小参数规模、更快响应、极高性价比

🎯 结构创新与超高上下文效率

DeepSeek-V4 在架构上实现了重大突破:

  • 全新注意力机制:Token-wise 压缩 + DSA(DeepSeek Sparse Attention)
  • 全球领先的长上下文效率:极大降低计算和内存成本
  • 1M context 成为所有官方服务的默认配置

🤖 Agent 专属优化

V4 对 Agent 能力进行了专门优化,无缝集成主流 AI Agent 工具:

  • 与 Claude Code、OpenClaw、OpenCode 等主流 Agent 工具无缝集成
  • 已驱动 DeepSeek 内部的 Agentic Coding 工作流
  • 专业分析师评估:可提供“显著低成本的优秀 Agent 能力”

💰 API 与定价

  • 保持现有 base_url,只需更新模型名为 deepseek-v4-pro 或 deepseek-v4-flash
  • 支持 OpenAI ChatCompletions 和 Anthropic API 双接口
  • deepseek-chat 和 deepseek-reasoner 将于 2026 年 7 月 24 日后完全退下

Flash 版本定价 $0.028/1M tokens,极具性价比优势。

🌍 行业影响

V4 的发布在多个层面产生深远影响:

芯片自主化

华为确认其最新 Ascend AI 处理器集群可支持 V4 模型。这意味着国产 AI 芯片在训练和推理环节都能承载顶级大模型,对减少对 Nvidia 的依赖具有战略意义。

国内竞争格局

V4 将国内其他开源模型立刻为直接竞争对手。自 V1 以来,DeepSeek 面临阿里、字节跳动等玩家的无断升级竞争,但 V4 的 Agent 专属优化和 1M context 让其在工具化方向占据独特优势。

市场反应

发布后,中国芯片代工商 SMIC 和华虹半导体股价分别上涨 9% 和 15%。同时 MiniMax、智谱等国内 AI 对手股价下跌约 8%,显示市场将 V4 视为重磅竞争威胁。

🔑 关键洞察

1.6T MoE + 1M Context:DeepSeek V4 在参数规模和上下文长度上同时突破,证明大模型的边界远未到达。MoE 架构让 49B 激活参数实现 1.6T 级别的能力,这是效率与性能的最佳平衡点。
Agent 原生时代到来了:V4 不只是一个更强的模型,而是第一个专为 Agent 场景设计的开源模型。与 Claude Code、OpenClaw 的集成说明 Agent 生态已成为模型历史的核心竞争维度。
开源策略的胜利:DeepSeek 坚持开源路线,在国内竞争和全球影响力下都取得了显著成果。开源不是失去竞争力,而是构建生态护城河。

💭 引发思考

DeepSeek V4 的发布标志着国产大模型进入了新阶段。当 1.6T 参数的开源模型可以在国产芯片上训练和推理时,AI 主权的含义在被重新定义。

更值得关注的是 Agent 原生设计的趋势。当模型厂商开始为 Agent 场景专门优化时,意味着整个技术栈正在从「对话式 AI」向「行动式 AI」转型。这对所有从事 Agent 开发的团队来说,都是一个明确的信号。

「逍遥云初 | 2026.04.28」