DeepSeek-V4-Pro-0813 正式版震撼发布。采用 MoE 架构(1.6T 总参数,49B 激活参数),Agent 能力大幅跃升,DeepSWE 得分从 12.8 跃升至 62.7。支持 Responses API 与 Codex 接入,国家超算互联网深度合作背书。
采用 MoE 稀疏专家架构,Agent 能力全面跃升,支持深度思考与 R1 思维链推理,1M 超长上下文与 384K 最大输出。
DeepSeek-V4-Pro-0813 正式版在多个维度实现重大突破,Agent 能力媲美海外闭源模型
采用 DSA 稀疏注意力机制,工具调用与多步推理能力全面提升。DeepSWE 得分从 12.8 跃升至 62.7,暴涨近 50 分,可媲美 Claude Fable 5 与 Opus-4.8。
完整展示推理过程,从问题拆解、逻辑推导到结论生成,每一步都清晰可溯。在复杂编程、数学证明、逻辑分析等高要求场景中展现卓越可靠性。
支持 PDF、Word、Excel、PPT、图片等格式上传,自动扫描并读取文件中的文字与结构化信息,可对文档进行摘要、分析、翻译、问答等操作。
实时获取最新信息并整合进推理过程,深度思考模式结合联网信息与内在知识库,输出结构严谨、信息全面的高质量回复。
100 万 Token 的上下文窗口,约等于《三体》三部曲体量。可一次性处理整本书、完整代码仓库或长期多轮对话历史,全局视野洞察。
简单问答用快速模式省时省力,复杂问题用深度思考模式获得更详尽的分析和推理过程。一键切换,灵活适配不同场景需求。
DeepSeek-V4-Pro 采用前沿 MoE 架构,各项技术指标达行业领先水平
| 技术维度 | 参数指标 | 说明 |
|---|---|---|
| 模型架构 | MoE 稀疏专家 | 混合专家架构,总参数 1.6T,激活参数 49B |
| 上下文窗口 | 1M Tokens | 约 75 万中文字,业界领先超长上下文 |
| 最大输出 | 384K Tokens | 支持超长分析报告与创作内容生成 |
| Agent 能力 | DeepSWE 62.7 | 从 12.8 跃升至 62.7,暴涨近 50 分 |
| 注意力机制 | DSA 稀疏注意力 | 全新注意力机制,世界知识与推理性能领先 |
| 思考模式 | 双模式切换 | 快速模式与深度思考模式一键切换 |
| API 接入 | Responses API / Codex | 兼容 OpenAI 与 Anthropic 双接口 |
| 算力支撑 | 十万卡级 | 国家超算互联网超智融合算力池 |
DeepSeek-V4-Pro 在多项权威基准测试中表现优异,整体性能可媲美海外闭源模型
DeepSeek-V4-Pro 支持 Responses API 与 Codex 接入,兼容 OpenAI 与 Anthropic 双接口标准
DeepSeek-V4-Pro 支持标准 Responses API 接口,可与现有 OpenAI SDK 无缝对接。仅需修改 base_url 即可完成迁移,代码改动最小化。
🔒 OpenAI 兼容支持 Codex 协议接入,兼容 Anthropic Claude SDK。开发者可根据现有技术栈灵活选择接入方式,快速集成 DeepSeek-V4-Pro 能力。
🔒 Anthropic 兼容国家超算互联网推出 AI 生态伙伴加速计划,新注册用户免费开放 3 个月 DeepSeek API 接口,Token Plan 千万词元低至 1 元。
👑 3个月免费登录国家超算互联网官网,通过「模型服务」专区一键接入 DeepSeek-V4 系列 API,依托安全可信的开发环境一站式完成部署与训练。
🚀 万卡级算力DeepSeek 提供 Pro、Flash、Coder 三大版本,满足从复杂推理到日常使用的多元需求
采用 MoE 架构(1.6T 总参数,49B 激活参数),支持 1M 超长上下文与深度思考模式。适合复杂推理、长文档分析、专业代码开发等高要求场景。
响应更快、成本更低,适合日常简单对话和快速问答场景。128K 上下文支持,兼顾性能与效率,是日常使用的最佳选择。
国家超算互联网深度合作 · 旗舰级 Agent 能力 · 完全免费无广告
关于 DeepSeek V4 Pro 的常见疑问,为您一一详细解答
国家超算互联网深度合作 · MoE 1.6T 旗舰架构 · DeepSWE 62.7 · Responses API 接入