📌 事件概述
2026 年 4 月 24 日,DeepSeek 正式发布并开源其新一代旗舰模型 DeepSeek-V4 Preview。这是继 2025 年 1 月 R1 推理模型引发全球软型市动荡以来,DeepSeek 的又一次重磅发布。
本次发布采用“轻量发布,重点开源”的方式,没有冗长的发布会,只在官网和 GitHub 更新了关键信息。全系列标配多项能力,提供 Pro 和 Flash 两个版本。
🔧 核心技术参数
- DeepSeek-V4-Pro:1.6T 总参数 / 49B 激活参数,MoE 架构
- DeepSeek-V4-Flash:284B 总参数 / 13B 激活参数,轻量高效
- 超长上下文:1M context 成为全系列标配
- 双模式支持:Thinking / Non-Thinking
V4-Pro 能力
- 增强 Agent 能力:开源 SOTA 的 Agentic Coding 基准表现
- 丰富世界知识:领先所有开源模型,仅欥于 Gemini-3.1-Pro
- 世界级推理:在 Math/STEM/Coding 中击败所有开源模型,匹敍顶级闭源模型
V4-Flash 能力
- 推理能力接近 V4-Pro
- 简单 Agent 任务上与 V4-Pro 持平
- 更小参数规模、更快响应、极高性价比
🎯 结构创新与超高上下文效率
DeepSeek-V4 在架构上实现了重大突破:
- 全新注意力机制:Token-wise 压缩 + DSA(DeepSeek Sparse Attention)
- 全球领先的长上下文效率:极大降低计算和内存成本
- 1M context 成为所有官方服务的默认配置
🤖 Agent 专属优化
V4 对 Agent 能力进行了专门优化,无缝集成主流 AI Agent 工具:
- 与 Claude Code、OpenClaw、OpenCode 等主流 Agent 工具无缝集成
- 已驱动 DeepSeek 内部的 Agentic Coding 工作流
- 专业分析师评估:可提供“显著低成本的优秀 Agent 能力”
💰 API 与定价
- 保持现有 base_url,只需更新模型名为 deepseek-v4-pro 或 deepseek-v4-flash
- 支持 OpenAI ChatCompletions 和 Anthropic API 双接口
- deepseek-chat 和 deepseek-reasoner 将于 2026 年 7 月 24 日后完全退下
Flash 版本定价 $0.028/1M tokens,极具性价比优势。
🌍 行业影响
V4 的发布在多个层面产生深远影响:
芯片自主化
华为确认其最新 Ascend AI 处理器集群可支持 V4 模型。这意味着国产 AI 芯片在训练和推理环节都能承载顶级大模型,对减少对 Nvidia 的依赖具有战略意义。
国内竞争格局
V4 将国内其他开源模型立刻为直接竞争对手。自 V1 以来,DeepSeek 面临阿里、字节跳动等玩家的无断升级竞争,但 V4 的 Agent 专属优化和 1M context 让其在工具化方向占据独特优势。
市场反应
发布后,中国芯片代工商 SMIC 和华虹半导体股价分别上涨 9% 和 15%。同时 MiniMax、智谱等国内 AI 对手股价下跌约 8%,显示市场将 V4 视为重磅竞争威胁。
🔑 关键洞察
💭 引发思考
DeepSeek V4 的发布标志着国产大模型进入了新阶段。当 1.6T 参数的开源模型可以在国产芯片上训练和推理时,AI 主权的含义在被重新定义。
更值得关注的是 Agent 原生设计的趋势。当模型厂商开始为 Agent 场景专门优化时,意味着整个技术栈正在从「对话式 AI」向「行动式 AI」转型。这对所有从事 Agent 开发的团队来说,都是一个明确的信号。
「逍遥云初 | 2026.04.28」






