DeepSeek
DeepSeek 当前 V4 API 线,覆盖 V4-Pro 与 V4-Flash,支持 1M 上下文、思考模式和工具调用。
DeepSeek 英文文档将 deepseek-v4-pro 与 deepseek-v4-flash 列为稳定公开 ID,当前分别路由到 V4-Pro-0813 与 V4-Flash-0731。两者支持思考与非思考模式、JSON 输出、工具调用和聊天前缀补全;FIM 补全仅支持非思考模式。计费现按 UTC 峰段和谷段变化,而模型 ID 保持不变。
专题指南基于来源梳理 DeepSeek V4 模型、API 价格、官方 Harness、第三方 Agent 运行时和实用接入指南。
编辑结论
适合把 DeepSeek 集成迁移到当前 V4 模型名,并评估长上下文推理工作流的开发者。
新项目不应从 deepseek-chat 或 deepseek-reasoner 旧别名开始。
V4 是当前 API 线,与更宽泛的 DeepSeek 品牌相比有独立迁移和计费影响。
Off-peak V4-Flash: $0.007/$0.22/$0.66; V4-Pro: $0.022/$0.66/$1.98 per M cache-hit/cache-miss/output tokens; peak rates are double
Topped-up balance, Granted balance, Platform billing
商用应遵守当前产品、API、模型许可证和计费条款。
处理敏感负载前,请核验提示词、文件、媒体上传、保留和训练使用条款。
智能体/代码任务使用 deepseek-v4-pro,更快或更低成本负载使用 deepseek-v4-flash。
使用文档中的 thinking 开关和 effort 控制处理重推理请求。
模型名称、额度、发布状态、区域接入和商用条款变化较快,采购或生产使用前请重新核验官方来源。
qwen
kimi-k2-api
zhipu-glm
价格 · EN · 核验于 2026-08-17
列出当前 V4-Pro-0813/V4-Flash-0731 路由、上下文与输出限制、功能、并发和已启用的峰谷价格。
最后核验: 2026-08-17
暂无已审核的评论。