系列文章见: 《回忆AI时代-从图灵机到人工智能》
DeepSeek
深度求索(DeepSeek)成立于2023年,专注于研究世界领先的通用人工智能底层模型与技术,挑战人工智能前沿性难题。在2025年初DeepSeek发布了高性价比的DeepSeek-R1模型,同时英伟达股价在2025年1月27日单日暴跌近17%,市值蒸发约6000亿美元。
DeepSeek有种后来者居上的的趋势,它的核心竞争力包括:
- 同等效果下,成本更低:DeepSeek最受关注的是其论文和技术报告中提到,它在训练和推理成本方面做了大量优化,在相对较低的成本下,取得了接近甚至在部分任务上超过国际领先模型的表现。
- 开源:DeepSeek将多个模型权重开源,任何企业或个人都可以下载部署、研究和二次开发。
- 推理能力强:特别是DeepSeek的R1推理模型,在数学、编程、逻辑推理等任务上表现突出。
成本更低
下面是OpenAI GPT API(GPT-5.5与DeepSeek API(V4 系列)的官方价格对比(截至 2026年8月)
| 模型 | 输入价格(1M Tokens) | 缓存输入(1M Tokens) | 输出价格(1M Tokens) | 上下文长度 |
|---|---|---|---|---|
| GPT-5.5 | $5.00 | $0.50 | $30.00 | 1.05M Tokens ([OpenAI Developers][1]) |
| DeepSeek V4 Pro | $0.435 | 约 $0.0036 | $0.87 | 1M Tokens ([Solvimon][2]) |
| DeepSeek V4 Flash | $0.14 | 约 $0.0028 | $0.28 | 1M Tokens ([Reuters][3]) |
| 对比 | GPT-5.5 | DeepSeek V4 Pro | DeepSeek V4 Flash |
|---|---|---|---|
| 输入价格 | $5.00 | 便宜约 11.5 倍 | 便宜约 35.7 倍 |
| 输出价格 | $30.00 | 便宜约 34.5 倍 | 便宜约 107 倍 |
| 缓存输入 | $0.50 | 便宜约 138 倍 | 便宜约 179 倍 |
可以看出,在大规模文本生成场景下,DeepSeek的API成本优势非常明显。
开源
开源是DeepSeek相比ChatGPT(OpenAI 旗舰模型)的核心优势之一,但它的价值主要体现在企业和开发者。
| 优势 | DeepSeek(开源) | ChatGPT(闭源) |
|---|---|---|
| 模型权重 | 可下载 | 不提供 |
| 私有化部署 | 可以 | 不支持旗舰模型 |
| 离线运行 | 可以 | 不可以 |
| 模型微调 | 可以 | 无法微调模型权重 |
| 查看模型结构 | 可以 | 不公开 |
| 自定义修改 | 可以 | 不可以 |
| 数据完全本地 | 可以 | 需使用云服务(除特定企业方案) |
| 社区贡献 | 全球开发者参与 | 官方维护 |
举一个具体的应用场景,譬如银行对数据非常重视,可以将模型下载到银行内网,这样不会向公网发送信息更安全可靠。