
月访问量
250.0M
累计浏览
84
用户评分
4.4
收录时间
2026-07
产品介绍
产品介绍
DeepSeek V4 Pro 是深度求索 2026 年推出的旗舰大模型。2026 年 8 月 12 日,DeepSeek 官网 API 文档悄然更新,模型版本从预览版正式切换至 DeepSeek-V4-Pro-0813,标志着 V4 Pro 正式版全面上线。正式版在 Agent 能力上大幅提升,支持 Responses API 和 Codex 接入,综合性能接近 Anthropic Fable 5 水平,部分指标超越。SWE-bench Verified 编程基准测试达到 80.6%,创下开源模型最高分。
模型采用 1.6 万亿总参数 / 490 亿激活参数的 MoE 架构,激活率仅 3.06%,支持 1M token 上下文窗口和最高 384K token 输出。MIT 开源协议,可自由商用。2026 年 8 月 17 日起,DeepSeek API 正式实行峰谷定价机制,这是国产大模型首次引入算力分级计价,空闲时段价格仅为高峰时段的一半。
核心功能
- 正式版 V4-Pro-0813:2026 年 8 月 12 日转正,Agent 能力大幅提升
- SWE-bench Verified 80.6%:开源模型编程最高分,接近闭源旗舰
- 1.6T MoE 架构:49B 激活参数,激活率仅 3.06%,推理效率极高
- 1M 上下文 + 384K 输出:支持超长代码库分析和大规模文档处理
- Responses API 支持:新增 Responses API 接口,适配智能体应用开发
- Codex 接入:支持 Codex 编程智能体接入
- 峰谷定价机制:2026 年 8 月 17 日生效,空闲时段价格减半
- OpenAI 兼容 API:零迁移成本,改 base_url 即可切换
- MIT 开源协议:模型权重可自托管,支持商业化使用
定价说明(2026年8月17日起生效)
高峰时段(北京时间 9:00-12:00、14:00-18:00):
- V4-Pro:输入缓存命中 ¥0.30/百万 tokens,缓存未命中 ¥9.00/百万 tokens,输出 ¥27.00/百万 tokens
- V4-Flash:输入缓存命中 ¥0.10/百万 tokens,缓存未命中 ¥3.00/百万 tokens,输出 ¥9.00/百万 tokens
空闲时段(其余时间,价格减半):
- V4-Pro:输入缓存命中 ¥0.15/百万 tokens,缓存未命中 ¥4.50/百万 tokens,输出 ¥13.50/百万 tokens
- V4-Flash:输入缓存命中 ¥0.05/百万 tokens,缓存未命中 ¥1.50/百万 tokens,输出 ¥4.50/百万 tokens
API 调用
from openai import OpenAI
client = OpenAI(
api_key="your-deepseek-key",
base_url="https://api.deepseek.com"
)
response = client.chat.completions.create(
model="deepseek-v4-pro",
messages=[{"role": "user", "content": "用 Python 实现快速排序"}]
)
print(response.choices[0].message.content)
新开发者账户赠送 500 万 token 免费额度。
典型使用场景
- 成本敏感的大规模推理任务(闲时价格极具竞争力)
- AI 编程智能体和代码审查(SWE-bench 80.6%)
- 长周期自主任务和多步骤 Agent 工作流
- 数学推理和科学计算
- 私有化部署(MIT 开源权重自托管)
平台支持
通过 DeepSeek API、AWS Bedrock、Azure AI Foundry、硅基流动访问。MIT 许可证开源,权重可从 HuggingFace 下载。