与 DeepSeek V4 Flash 或 Pro 对话
V4 Flash 适合快速、经济的对话;V4-Pro 适合复杂编程、推理和工具工作流。两种模型都能用于创建私有 Agent。
选择 DeepSeek V4 Flash 或 Pro
直接与任一共用模型对话,或新建私有 Agent。Flash 更快、成本更低;Pro 适合更复杂的编程和推理任务。
立即对话或创建 Agent
直接与固定模型对话,或使用自己的 Skill 和指令创建私有 Agent。
立即对话或创建 Agent
直接与固定模型对话,或使用自己的 Skill 和指令创建私有 Agent。
发布与 API 状态
来自 DeepSeek 官方文档的当前公开事实。
DeepSeek V4 Flash 与 Pro 规格
先比较两者的共用能力,再按速度和成本选择 Flash,或按复杂 Agent 任务选择 Pro。
- 模型 ID
- deepseek-v4-pro
- 上下文窗口
- 1M
- 最大输出
- 384K
- 模态
- 文本
- 推理
- Thinking 与非 Thinking
- 能力
- JSON、工具、Prefix、FIM
Pro 版本使用 deepseek-v4-pro;deepseek-v4-flash 是成本更低的配套模型。
DeepSeek 文档记录 V4-Pro 和 V4-Flash 均支持 100 万上下文。
DeepSeek 列出的最大输出为 384K Token。
价格表记录的是文本聊天能力、工具调用、JSON 输出和 FIM beta。
两个 V4 模型均支持 Thinking 和非 Thinking 模式。
DeepSeek 列出 JSON 输出、工具调用、Chat Prefix Completion 和 FIM Completion beta。
适合的 Agent 场景
优先用于受益于长上下文和低 Token 成本的工作负载。
决策证据
对 Agent 选型有意义的 Provider 官方事实。
| 维度 | 官方证据 | 决策用途 |
|---|---|---|
| Agentic 能力 | DeepSeek 将 V4-Pro 描述为面向 agentic coding 优化,并与主流 coding agents 集成。 | 适合进入编程和工具循环工作流候选,但仍需用自己的验收场景测试。 |
| 长上下文 | DeepSeek 文档记录 100 万上下文和 384K 最大输出。 | 适合 Agent 需要一次持有大型仓库或文档的场景。 |
| Token 价格 | DeepSeek 公布 V4-Pro 与 V4-Flash 的缓存命中、缓存未命中和输出价格。 | 尤其在重复长提示能命中缓存时,评估成功任务成本。 |
DeepSeek 发布页说法是 Provider 自述;生产前必须用自己的任务验证。
公开 API 价格
DeepSeek pricing 中每百万 Token 的价格。
| 模型 | 输入 | 输出 |
|---|---|---|
| deepseek-v4-pro | $0.003625 hit / $0.435 miss | $0.87 |
| deepseek-v4-flash | $0.0028 hit / $0.14 miss | $0.28 |
价格按每百万 Token 计。DeepSeek 说明产品价格可能变化,建议定期检查价格页。
运营限制
生产 Agent 切换前需要验证这些约束。
DeepSeek V4 Flash 与 Pro 常见问题
回答 DeepSeek V4 在线对话、Flash 与 Pro 选择、API 价格、上下文和 Agent 创建问题。
选择适合任务的 DeepSeek V4 模型
用 Flash 获得更快、更低成本的对话,用 Pro 处理复杂工作,或创建私有 DeepSeek V4 Agent。

