DeepSeek API

3天前更新 5 0 0

全球价格最低的 frontier 级 MaaS,V4-Flash 输入 $0.14/MTok,V4-Pro 永久降价后仅 $0.435/MTok。

所在地:
中国
语言:
中文
收录时间:
2026-07-26
DeepSeek APIDeepSeek API
开发商:深度求索(DeepSeek)
核心模型:DeepSeek V4-Flash(默认)/ DeepSeek V4-Pro
上下文:1M(最大输出 384K)
多模态:文本、图像(V4-Flash)
平台类型:官方
计价方式:V4-Flash:输入 $0.14/MTok(缓存命中 $0.0028),输出 $0.28/MTok;V4-Pro:输入 $0.435/MTok(缓存命中 $0.003625),输出 $0.87/MTok(永久价)
免费额度:新账户 500 万 tokens / 30 天
接入方式:OpenAI 兼容 / Anthropic 格式 / SDK
适用场景:企业接入、应用开发、推理、代码、长文档处理
特色功能:批量推理、Json Output、Tool Calls、FIM 补全、双 BASE URL 兼容
可访问性:直连

DeepSeek API 是深度求索官方推出的模型即服务,2026 年 4 月发布DeepSeek V4 系列(V4-Flash + V4-Pro),全系列 1M 上下文、384K 最大输出。BASE URL 同时兼容 OpenAI 格式和 Anthropic 格式。V4-Pro 于 2026 年 5 月 31 日结束 2.5 折优惠后正式调整为原价的 1/4 并永久化,创下全球大模型价格新低。新账户赠送 500 万 tokens/30 天免费额度,国内直连接入。

 

产品概述

DeepSeek 于 2024 年推出 API 平台,凭借 MoE 架构和激进的自动前缀缓存(APC),把模型推理成本压到美国同行 1/10~1/30。2026 年 4 月 24 日发布 V4-Flash 与 V4-Pro 并同步开源,上下文从 128K 扩展到 1M(近 10 倍);4 月 26 日全系列输入缓存命中价降至首发价的 1/10;5 月 22 日宣布 V4-Pro 永久降价至原价的 1/4。V4-Flash 定位廉价高速工作马(默认模型),V4-Pro 定位 frontier 级推理(数学/代码/Agent)。deepseek-chatdeepseek-reasoner 这两个旧模型名将在日后弃用,目前出于兼容仍分别对应 V4-Flash 的非思考/思考模式。

 

核心能力

  • 文本生成:V4-Flash 通用对话、写作、代码、翻译(默认工作马)
  • 推理:V4-Pro 思考模式,数学/代码/多步逻辑推理 SOTA
  • 长上下文:1M token 窗口,可一次性处理整本书/代码仓库级别信息
  • 多模态:V4-Flash 支持文本+图像输入
  • 高级功能:Json Output、Tool Calls、FIM 代码补全(Beta)、对话前缀续写(Beta)

 

优势亮点

  • 全球价格最低:V4-Flash 输入缓存未命中 $0.14/MTok、输出 $0.28/MTok;V4-Pro 永久降价后输入 $0.435/MTok、输出 $0.87/MTok——frontier 推理模型里全球最便宜
  • 1M 上下文 + 384K 最大输出,长文档处理碾压同级
  • 双 BASE URL 兼容 OpenAI 和 Anthropic 格式,迁移成本极低
  • MoE 架构 + APC 缓存命中价低至 $0.0028/MTok(98% 折扣)
  • 新账户 500 万 tokens/30 天免费额度,免信用卡
  • 国内直连,无需 VPN
  • 模型开源(V4 系列已开源),可私有化部署

 

短板

  • 2026 年 7 月起 V4 系列取消夜间低谷折扣,并预告高峰时段可能加倍收费(目前未生效)
  • 旧模型名 deepseek-chat / deepseek-reasoner 于 2026 年 7 月 24 日退休,老代码需迁移到 V4 模型名
  • 企业级 SLA 和 ToB 服务成熟度不及阿里百炼/火山方舟
  • 多模态能力弱于 GPT-5.5 / Claude Opus 4.8(V4-Flash 仅文本+图像,无视频/音频)
  • 文档和 SDK 生态丰富度略逊 OpenAI

 

适用人群

预算敏感的开发者、初创团队、需要 frontier 推理能力但预算有限的项目、对价格敏感的大批量调用场景。

相关导航