跳转到内容

DeepSeek:修订间差异

轻之舟百科,让知识轻装启航
云云​(留言 | 贡献)
创建页面,内容为“ DeepSeek(全称:杭州深度求索人工智能基础技术研究有限公司)是一家专注于通用人工智能(Artificial General Intelligence, AGI)研发的人工智能公司,由梁文锋于2023年7月创立,总部位于杭州。该公司以开发高性价比的大语言模型著称,其模型采用开源权重策略发布,在数学推理、代码生成与自然语言处理等领域达到业界前沿水平。<ref name=":0">[https://ww…”
 
IdleTap-bot​(留言 | 贡献)
由旧格式Infobox转换为新参数格式(label/data),修复空信息框(由IdleTap-bot执行)
第1行: 第1行:
    
    
    
    
DeepSeek(全称:杭州深度求索人工智能基础技术研究有限公司)是一家专注于通用人工智能(Artificial General Intelligence, AGI)研发的人工智能公司,由梁文锋于2023年7月创立,总部位于杭州。该公司以开发高性价比的[[大语言模型]]著称,其模型采用开源权重策略发布,在数学推理、代码生成与自然语言处理等领域达到业界前沿水平。<ref name=":0">[https://www.britannica.com/money/DeepSeek DeepSeek | Rise, Technologies, Impact, & Global Response - Britannica Money]</ref><ref name=":1">[https://api-docs.deepseek.com/updates/ Change Log | DeepSeek API Docs]</ref>
DeepSeek(全称:杭州深度求索[[人工智能]]基础技术研究有限公司)是一家专注于通用人工智能(Artificial General Intelligence, AGI)研发的人工智能公司,由梁文锋于2023年7月创立,总部位于杭州。该公司以开发高性价比的[[大语言模型]]著称,其模型采用开源权重策略发布,在数学推理、代码生成与自然语言处理等领域达到业界前沿水平。<ref name=":0">[https://www.britannica.com/money/DeepSeek DeepSeek | Rise, Technologies, Impact, & Global Response - Britannica Money]</ref><ref name=":1">[https://api-docs.deepseek.com/updates/ Change Log | DeepSeek API Docs]</ref>


{{Infobox
{{Infobox
| 标题 = DeepSeek
| title = DeepSeek
| 内容 =  
 
{{!}}-
| label1 = 公司全称
! 公司全称
| data1 = 杭州深度求索人工智能基础技术研究有限公司
{{!}} 杭州深度求索人工智能基础技术研究有限公司
 
{{!}}-
| label2 = 英文名称
! 英文名称
| data2 = DeepSeek
{{!}} DeepSeek
 
{{!}}-
| label3 = 成立时间
! 成立时间
| data3 = 2023年7月
{{!}} 2023年7月
 
{{!}}-
| label4 = 创始人
! 创始人
| data4 = 梁文锋
{{!}} 梁文锋
 
{{!}}-
| label5 = 总部地点
! 总部地点
| data5 = 杭州
{{!}} 杭州
 
{{!}}-
| label6 = 所属行业
! 所属行业
| data6 = 人工智能
{{!}} 人工智能
 
{{!}}-
| label7 = 主要产品
! 主要产品
| data7 = DeepSeek-V3、DeepSeek-R1
{{!}} DeepSeek-V3、DeepSeek-R1
 
{{!}}-
| label8 = 开源许可
! 开源许可
| data8 = MIT License
{{!}} MIT License
 
{{!}}-
| label9 = 母公司
! 母公司
| data9 = High-Flyer Quant
{{!}} High-Flyer Quant
}}
}}



2026年8月11日 (二) 10:31的版本


DeepSeek(全称:杭州深度求索人工智能基础技术研究有限公司)是一家专注于通用人工智能(Artificial General Intelligence, AGI)研发的人工智能公司,由梁文锋于2023年7月创立,总部位于杭州。该公司以开发高性价比的大语言模型著称,其模型采用开源权重策略发布,在数学推理、代码生成与自然语言处理等领域达到业界前沿水平。[1][2]

DeepSeek
公司全称杭州深度求索人工智能基础技术研究有限公司
英文名称DeepSeek
成立时间2023年7月
创始人梁文锋
总部地点杭州
所属行业人工智能
主要产品DeepSeek-V3、DeepSeek-R1
开源许可MIT License
母公司High-Flyer Quant

历史

起源与成立

DeepSeek的前身可追溯至量化对冲基金High-Flyer(幻方量化)。该基金由梁文锋与大学友人于2015年创立,专注于利用机器学习进行量化投资。[3]2021年,High-Flyer投资约10亿元人民币建设AI高性能计算平台"萤火二号"(Fire-Flyer II),此前已投资约2亿元建设"萤火一号"(Fire-Flyer I),为其后续AI研发奠定了算力基础。[3]

2023年4月,High-Flyer宣布成立通用人工智能实验室,专注于独立于金融业务的AI工具研发。同年7月,该实验室正式注册为DeepSeek公司,由High-Flyer作为主要投资方。[1]公司成立初期未引入外部风险投资,梁文锋曾表示公司最大的挑战并非资金,而是高性能芯片的出口限制。[4]

产品发布历程

2024年5月,DeepSeek发布对话模型DeepSeek-V2,凭借极高的性价比在业界引发关注,并触发了一场价格战,迫使多家大型科技公司下调其AI模型定价。[1]

2024年12月,DeepSeek发布DeepSeek-V3,该模型采用混合专家架构(Mixture of Experts, MoE),总参数量达6710亿,每次前向传播激活370亿参数,上下文窗口支持128K token。[5]

2025年1月,DeepSeek发布推理模型DeepSeek-R1及其聊天应用。该模型通过大规模强化学习训练,在数学、代码与推理基准测试中达到与OpenAI o1相当的水平。[5]据Nature杂志报道,R1的发布"震撼了人工智能界",并"立即证明美国在AI领域的领先优势并不像许多专家认为的那样大"。[6]同年12月,梁文锋入选Nature年度"十大人物"(Nature's 10)。[6]

2025年3月,DeepSeek发布V3-0324版本,改进了推理、网页开发与中文写作能力。同年5月发布R1-0528,推理能力显著提升,幻觉率降低45%至50%。[5]8月发布V3.1,引入混合思考模式,可在推理与非推理模式间切换。[7]12月发布V3.2,采用非标准稀疏注意力变体。[7]

技术与产品

模型架构

DeepSeek-V3基于混合专家架构(Mixture of Experts, MoE),并采用多头潜在注意力机制(Multi-Head Latent Attention, MLA)。[7]该架构设计使得模型在保持大规模参数总量的同时,通过仅激活部分专家网络来控制推理成本。

开源策略

DeepSeek采用开源权重策略,其模型权重通常在MIT等宽松许可证下发布,允许商业使用、微调和衍生模型开发。[8]公司创始人梁文锋在2024年采访中明确表示,DeepSeek不会转向闭源模式,认为"构建强大的技术生态系统比封闭商业模式更重要"。[4]

主要产品

  • DeepSeek-V3:通用大语言模型,适用于内容创作、翻译、问答等任务。
  • DeepSeek-R1:专用推理模型,针对复杂数学问题求解、代码挑战与科学推理优化,生成逐步推理链。
  • DeepSeek-V3.1:混合模型,支持通过聊天模板切换思考模式与非思考模式。[5]

创始人

梁文锋(Liang Wenfeng)出生于广东湛江,2006年获浙江大学电子信息工程学士学位,2010年获通信与信息工程硕士学位。2015年,他与友人共同创立High-Flyer量化对冲基金。[9]2023年创立DeepSeek并担任首席执行官。

2025年3月,梁文锋以约330亿元人民币身家首次登上胡润全球富豪榜。[10]2026年6月,DeepSeek完成首轮融资后,其个人净资产跃升至360亿美元,成为身家最高的AI模型创作者。[9]

融资与估值

DeepSeek成立初期完全由High-Flyer出资,未引入外部资本。[3]2026年6月,公司完成首轮融资,筹集超过74亿美元,估值从4月的约100亿美元升至超过500亿美元。[9]腾讯领投约15亿美元,宁德时代投资约7.35亿美元。[9]梁文锋个人投入约30亿美元,保留约78%的公司股权及完整运营控制权。[9]

参考文献