DeepSeek
基本信息
- 类型:AI研究实验室 / 大模型公司
- 总部:中国
- 母公司:幻方量化(High-Flyer Quant)
- 创始人:梁文锋
简介
DeepSeek是中国领先的AI研究机构,以开源大模型闻名。2025年初凭借DeepSeek-R1和DeepSeek-V3震惊全球AI圈,2026年4月发布V4版本展示了从英伟达CUDA生态迁移到华为昇腾芯片的重大技术突破。
关键产品
| 产品 | 发布时间 | 特点 |
|---|---|---|
| DeepSeek-V3 | 2025年初 | 开源,震惊全球AI圈 |
| DeepSeek-R1 | 2025年初 | 推理能力显著提升 |
| DeepSeek-V4 | 2026-04-24 | 华为昇腾迁移,百万上下文,编程能力接近Claude Opus 4.6 |
核心事件
架构迁移
- V4迟到15个月的真正原因:从英伟达CUDA迁移到华为昇腾芯片
- 在华为昇腾950PR上推理速度比迁移初期提升35倍
- 打破了”开源模型必须以英伟达芯片作为基建”的行业铁律
人才流失
- R1核心作者被字节跳动挖走
- V2核心作者被小米千万年薪挖走
- 核心员工期权没有市场化定价
技术特点
- 编程能力:Codeforces得分超过GPT-5.4;SWE-Verified与Claude Opus 4.6几乎打平
- 成本优势:V4-Pro API成本约为Claude Opus 4.6的1/7、GPT-5.4的1/4
- 训练效率:DeepSeek v3训练碳排放约597吨,远低于同等规模其他模型
企业文化
引用荀子名言作为结尾:
“不诱于誉,不恐于诽,率道而行,端然正己。”
发布风格:先做出来,开源,上线,然后发布公告。没有发布会,没有直播,没有倒计时预热。
相关链接
相关实体
[2026-08-10] E-Bench 成本对照:约 1/22 的成本
腾讯混元 E-Bench(323 道有状态任务)同时统计每个模型完成任务的 API 成本(来源:腾讯 Agent 评测):
| 模型 | 单任务成本 | 准确率 |
|---|---|---|
| DeepSeek-V4-Pro | 0.028 美元 | 47.7% |
| [[wiki/entities/Kimi-K3 | Kimi-K3]] | 0.634 美元 |
成本与准确率不成比例——Agent 选型须在”场景 × 可靠性 × 成本”多维成绩单上权衡(见 Agent 评测范式演变)。
另:2026-08-07 AOE Tech Labs 以 DeepSeek-V4-Flash(混合价 0.175/M)为底座,接入自研 Floatboat Harness 后,在五项第三方 Agent 基准(DeepSWE、Terminal Bench 2.1、Toolathlon、BrowseComp、AutomationBench)全胜贵 57.1 倍(10/M)的 Claude Opus 4.8——同一权重、唯一变量是 Harness。见 Agent Harness 与 Floatboat 源页。