DeepSeek

基本信息

  • 类型:AI研究实验室 / 大模型公司
  • 总部:中国
  • 母公司:幻方量化(High-Flyer Quant)
  • 创始人:梁文锋

简介

DeepSeek是中国领先的AI研究机构,以开源大模型闻名。2025年初凭借DeepSeek-R1和DeepSeek-V3震惊全球AI圈,2026年4月发布V4版本展示了从英伟达CUDA生态迁移到华为昇腾芯片的重大技术突破。

关键产品

产品发布时间特点
DeepSeek-V32025年初开源,震惊全球AI圈
DeepSeek-R12025年初推理能力显著提升
DeepSeek-V42026-04-24华为昇腾迁移,百万上下文,编程能力接近Claude Opus 4.6

核心事件

架构迁移

  • V4迟到15个月的真正原因:从英伟达CUDA迁移到华为昇腾芯片
  • 在华为昇腾950PR上推理速度比迁移初期提升35倍
  • 打破了”开源模型必须以英伟达芯片作为基建”的行业铁律

人才流失

  • R1核心作者被字节跳动挖走
  • V2核心作者被小米千万年薪挖走
  • 核心员工期权没有市场化定价

技术特点

  • 编程能力:Codeforces得分超过GPT-5.4;SWE-Verified与Claude Opus 4.6几乎打平
  • 成本优势:V4-Pro API成本约为Claude Opus 4.6的1/7、GPT-5.4的1/4
  • 训练效率:DeepSeek v3训练碳排放约597吨,远低于同等规模其他模型

企业文化

引用荀子名言作为结尾:

“不诱于誉,不恐于诽,率道而行,端然正己。”

发布风格:先做出来,开源,上线,然后发布公告。没有发布会,没有直播,没有倒计时预热。

相关链接

相关实体

  • 张一鸣 - 字节跳动创始人(竞争对手视角)
  • YC - 投资方

[2026-08-10] E-Bench 成本对照:约 1/22 的成本

腾讯混元 E-Bench(323 道有状态任务)同时统计每个模型完成任务的 API 成本(来源:腾讯 Agent 评测):

模型单任务成本准确率
DeepSeek-V4-Pro0.028 美元47.7%
[[wiki/entities/Kimi-K3Kimi-K3]]0.634 美元

成本与准确率不成比例——Agent 选型须在”场景 × 可靠性 × 成本”多维成绩单上权衡(见 Agent 评测范式演变)。

另:2026-08-07 AOE Tech Labs 以 DeepSeek-V4-Flash(混合价 0.175/M)为底座,接入自研 Floatboat Harness 后,在五项第三方 Agent 基准(DeepSWE、Terminal Bench 2.1、Toolathlon、BrowseComp、AutomationBench)全胜贵 57.1 倍(10/M)的 Claude Opus 4.8——同一权重、唯一变量是 Harness。见 Agent HarnessFloatboat 源页