深度求索是中国杭州的人工智能公司,由幻方量化创始人梁文锋于2023年创立。其开源大模型 DeepSeek-V3 与推理模型 DeepSeek-R1 以远低于同行的训练成本达到一流性能,2025年初引发全球 AI 行业震动,并带动开源权重模型浪潮。

| 成立时间 | 2023年 |
| 创始人 | 梁文锋 |
| 总部 | 中国杭州 |
| 代表模型 | DeepSeek-V3、DeepSeek-R1 |
| 特色 | 开放权重、低成本训练 |
深度求索(DeepSeek)是一家总部位于中国杭州的人工智能公司,全称杭州深度求索人工智能基础技术研究有限公司,2023年由量化投资机构幻方量化(High-Flyer)创始人梁文锋创立,专注大语言模型的研发,以开放权重和极致的工程效率著称。
深度求索的资金与算力主要来自幻方量化早年储备的 GPU 集群,团队以年轻研究员为主。公司自2023年起陆续发布 DeepSeek Coder、DeepSeek LLM、DeepSeek-V2 等模型,2024年底发布的 DeepSeek-V3 采用混合专家(MoE)架构,总参数约6710亿、每次推理仅激活约370亿,官方披露的训练成本仅数百万美元量级,远低于业界同档模型。2025年1月发布的推理模型 DeepSeek-R1 通过大规模强化学习习得思维链推理能力,性能对标 OpenAI 的 o1,且以宽松许可开放模型权重。R1 发布后 DeepSeek 应用登顶多国应用商店,美股 AI 算力板块单日大跌,英伟达市值一度蒸发数千亿美元,被媒体称为 AI 领域的斯普特尼克时刻。
DeepSeek 的成功促使各大厂商重新评估算力投入与模型效率的关系,也引发了关于数据来源、内容审查与各国监管审查的讨论,部分国家的政府机构限制在公务设备上使用其应用。
问:DeepSeek 的模型真的免费吗?答:模型权重开放下载,可在自有硬件上免费部署与商用;官方 App 与网页版免费使用,API 按用量计费但价格显著低于同类。
问:DeepSeek-R1 和普通大模型有何不同?答:R1 属于推理模型,回答前会生成较长的思维链逐步推导,在数学、代码与逻辑任务上表现更强,但响应更慢、消耗更多算力。
问:深度求索和幻方量化是什么关系?答:深度求索由幻方量化孵化,创始人同为梁文锋,早期算力来自幻方的萤火超算集群,后独立运营。

| 成立时间 | 2023年 |
| 创始人 | 梁文锋 |
| 总部 | 中国杭州 |
| 代表模型 | DeepSeek-V3、DeepSeek-R1 |
| 特色 | 开放权重、低成本训练 |
登录 后参与讨论
暂无讨论,来发表第一条评论吧