DeepSeek深度求索

系列文章见: 《回忆AI时代-从图灵机到人工智能》

DeepSeek

深度求索(DeepSeek)成立于2023年,专注于研究世界领先的通用人工智能底层模型与技术,挑战人工智能前沿性难题。在2025年初DeepSeek发布了高性价比的DeepSeek-R1模型,同时英伟达股价在2025年1月27日单日暴跌近17%,市值蒸发约6000亿美元。

DeepSeek有种后来者居上的的趋势,它的核心竞争力包括:

  • 同等效果下,成本更低:DeepSeek最受关注的是其论文和技术报告中提到,它在训练和推理成本方面做了大量优化,在相对较低的成本下,取得了接近甚至在部分任务上超过国际领先模型的表现。
  • 开源:DeepSeek将多个模型权重开源,任何企业或个人都可以下载部署、研究和二次开发。
  • 推理能力强:特别是DeepSeek的R1推理模型,在数学、编程、逻辑推理等任务上表现突出。

成本更低

下面是OpenAI GPT API(GPT-5.5与DeepSeek API(V4 系列)的官方价格对比(截至 2026年8月)

模型 输入价格(1M Tokens) 缓存输入(1M Tokens) 输出价格(1M Tokens) 上下文长度
GPT-5.5 $5.00 $0.50 $30.00 1.05M Tokens ([OpenAI Developers][1])
DeepSeek V4 Pro $0.435 约 $0.0036 $0.87 1M Tokens ([Solvimon][2])
DeepSeek V4 Flash $0.14 约 $0.0028 $0.28 1M Tokens ([Reuters][3])
对比 GPT-5.5 DeepSeek V4 Pro DeepSeek V4 Flash
输入价格 $5.00 便宜约 11.5 倍 便宜约 35.7 倍
输出价格 $30.00 便宜约 34.5 倍 便宜约 107 倍
缓存输入 $0.50 便宜约 138 倍 便宜约 179 倍

可以看出,在大规模文本生成场景下,DeepSeek的API成本优势非常明显。

开源

开源是DeepSeek相比ChatGPT(OpenAI 旗舰模型)的核心优势之一,但它的价值主要体现在企业和开发者。

优势 DeepSeek(开源) ChatGPT(闭源)
模型权重 可下载 不提供
私有化部署 可以 不支持旗舰模型
离线运行 可以 不可以
模型微调 可以 无法微调模型权重
查看模型结构 可以 不公开
自定义修改 可以 不可以
数据完全本地 可以 需使用云服务(除特定企业方案)
社区贡献 全球开发者参与 官方维护

举一个具体的应用场景,譬如银行对数据非常重视,可以将模型下载到银行内网,这样不会向公网发送信息更安全可靠。