DeepSeek 与华为生死结盟:16 万颗芯片点亮荒原

核心要点

地缘封锁倒逼DeepSeek与华为深度绑定。梁文锋押注200亿元,在内蒙古部署16万颗升腾芯片,以高昂硬件折损率换取自主可控,试图打破CUDA生态垄断,完成从依赖英伟达到全面国产化的惊险一跃。

据 Woofun AI 消息,DeepSeek华为在地缘科技封锁的夹缝中达成历史性战略绑定,梁文锋任正非两大科技巨头背后的核心人物,共同推动了一场旨在打破英伟达 CUDA 生态垄断的算力重构实验。这并非简单的商业合作,而是基于生存危机的深度互信:一方需要摆脱对受限英伟达芯片的依赖,另一方急需顶级模型为国产硬件背书。双方通过巨额资本投入与底层架构迁移,试图在内蒙古草原的荒原上,用 16 万颗国产芯片点亮中国 AI 自主可控的未来。

2019 年,中国量化交易领域的算力布局呈现出一种极度务实且隐秘的特征。在杭州一栋写字楼的机房内,幻方量化部署了 1100 张 GPU,投入近 2 亿元人民币,构建了一个代号"萤火一号"的集群。该集群占地接近一个篮球场,其唯一任务是在每日集合竞价前,从海量 tick 数据中挖掘出下一个基点的 alpha 收益。

这种将巨额电费转化为账面超额收益的模式,在当年大模型尚未成为显学的背景下,显得既轻盈又现实。到了 2021 年,幻方的算力赌注翻了五倍,梁文锋掏出 10 亿元,扫下上万张英伟达 A100 显卡,机房面积扩大至十个篮球场,形成"萤火二号"。

这一时期,幻方坚信算法优于人肉判断,完全依赖机器进行高频交易。然而,2022 年 10 月,美国商务部实施出口管制,彻底焊死了顶级算力通道。梁文锋在禁令落地前完成了筹码囤积,这一前瞻性布局使其在随后的算力寒冬中拥有了宝贵的缓冲期,但也让他意识到,仅靠囤积被阉割的特供版芯片无法解决长远的性能瓶颈。

与幻方在暗处默默积累不同,华为的芯片战略是一场持续十五年的"备胎"生存之战。1987 年,任正非带着 2.1 万元在深圳南油的一间民房创立华为,从代理交换机起步,逐步发展为全球通信巨头。2004 年,华为成立全资子公司海思,其核心使命并非追求短期商业回报,而是为确保在外部断供时拥有兜底筹码。

这一战略在 2018 年 12 月 1 日孟晚舟于温哥华机场被扣后被迫浮出水面。2019 年 5 月 16 日,美国商务部将华为列入实体清单,次日凌晨,海思总裁何庭波发出全员信,宣布所有备胎芯片一夜转正。三个月后,华为推出升腾 910 芯片。

这一举动标志着华为从被动的防御转向主动的技术突围,尽管当时面临全球先进制程断供的困境,但华为选择了一条通过工程堆叠来弥补单颗算力不足的艰难路径。

断供后的工程突围展现了两种截然不同的技术美学。2020 年 9 月,台积电停止为华为代工 5 纳米麒麟 9000 芯片,华为虽拥有顶尖设计能力,却无代工厂接单。面对英伟达成熟的 CUDA 生态,华为采取"暴力美学",利用中国丰富的绿电资源和工程师红利,将数千颗性能稍逊的升腾芯片强行互联,以高功耗为代价换取总算力提升。

与此同时,DeepSeek 则在受限环境中追求极致优化。2022 年 10 月英伟达 A100 与 H100 对华禁售,后续仅能获取特供版 A800 与 H800。2024 年底,DeepSeek 仅用 2048 张 H800 显卡,耗资约 557.6 万美元,训练出性能比肩一线大厂的 DeepSeek-V3 模型。相比之下,海外实验室达到同等水平需动用上万张顶级显卡并烧掉数亿美元。

这种近乎残酷的工程洁癖,使 DeepSeek 在被阉割的硬件上榨干了每一兆算力,但也凸显了工具落后带来的根本性焦虑。

DeepSeek-R1 的开源引发了全球市场的剧烈震荡。2025 年 1 月 20 日,DeepSeek 毫无预兆地开源了具备深度推理能力的 DeepSeek-R1,其公开训练成本仅为几百万美元,远低于硅谷头部实验室的预算。

这一举动迅速引发资本市场重估,七天后,英伟达在美股周一开盘当日市值蒸发近 5900 亿美元,创下单一上市公司单日最大市值跌幅纪录。DeepSeek 之所以能发起如此激烈的价格战,得益于其独特的资本结构:从未接受外部机构投资,完全依靠幻方在二级市场高频交易积累的现金流支撑。

这种财务独立性使其能够采取激进策略,不仅打穿了大模型商业接口的价格体系,更向全球证明了低成本高效训练的可能性,从而动摇了英伟达基于高昂算力成本的定价权根基。

Woofun AI 整理数据显示,软硬件结合的初步验证揭示了 DeepSeek 与华为早期秘密适配的成果。2025 年初,华为在升腾社区上线了 R1 和 V3 的全套部署镜像,成功跑通了前沿模型在国产芯片上的运行,打破了"国产芯片无法运行大模型"的行业定论。

值得注意的是,DeepSeek 与华为的深度绑定早于公开时间,梁文锋团队已悄悄对升腾底层环境进行了深度适配与压力测试。尽管升腾 910C 的单卡浮点算力仅约为英伟达旗舰 B200 的三分之一,华为通过工程架构创新,利用高规格光纤将 384 颗 910C 芯片串联成"超节点",以四倍于英伟达架构的恐怖功耗,勉强拉平了总算力水位。

这种借助内陆戈壁滩廉价风电和光伏资源的方案,虽姿态不够体面,但在能源禀赋包容消耗的前提下,实现了技术可行性,为全面迁移奠定了初步基础。

全面迁移至国产算力底座面临着巨大的融资压力与生态剥离挑战。2026 年,DeepSeek 罕见地启动外部融资,总额高达 74 亿美元,其中梁文锋个人投入 200 亿元人民币,占比近五分之二。这笔巨额资金主要用于解决从英伟达 CUDA 生态向华为 CANN 架构迁移的软件栈难题。这并非简单的代码搬家,而是涉及底层算子的手写重构、数值精度的千万次对齐以及编译报错的逻辑重塑。

杭州与深圳的工程师团队通宵达旦地进行手动调优,以消除陌生的开发文档带来的障碍。2026 年 4 月 15 日,英伟达 CEO 黄仁勋Dwarkesh Patel 的播客中罕见地表示,若 DeepSeek 在华为升腾平台跑通并发布下一代旗舰,"那对美国而言,将是灾难性的(catastrophic)"。黄仁勋的焦虑并非源于订单损失,而是在于英伟达经营二十年的 CUDA 生态护城河被凿开缺口,全球顶尖模型团队首次公开拒绝为该规则买单。

算力代差的残酷现实体现在硬件数量的巨大膨胀与产能供给的逼仄之间。梁文锋测算,若要训练出达到海外顶尖基准的模型,使用英伟达最新旗舰显卡需约 5 万张,而换成华为升腾 950 系列,数量需膨胀至 20 万张,硬件折损率高达四比一,且存在至少两年的代际滞后。更严峻的是,华为当前能腾挪给 DeepSeek 的单批次配额仅约 1.6 万张,远不足以支撑参数规模的硬碰硬。据 The Information 援引知情人士透露,梁文锋仍将整个公司的训练底座全盘押注于华为芯片,并指出这条路的尽头位于内蒙古。

这一决策意味着 DeepSeek 必须接受巨大的效率损失,以换取供应链的安全与自主权,这是创办以来最大的一笔战略赌注,也是在地缘政治压力下别无选择的必然结果。

内蒙古超级数据中心的规划标志着这一战略从纸面走向落地。2026 年 9 月,DeepSeek 被曝正在内蒙古规划一座超大型数据中心,计划部署整整 16 万颗华为升腾芯片,园区能耗按 GW 级规划。核心型号为升腾 950DT,单颗封装 144GB 超大内存,通过极致芯片内总线实现 token 的低延迟分发。该型号早在 2025 年 9 月华为全联接大会上由轮值董事长徐直军公布,华为确立了从 950PR、950DT 到 960970 一年一代的算力演进节奏。虽然梁文锋当时未出席大会,但他深知在先进制程被卡死的背景下,低廉的绿电与无边无际的荒原是中国唯一的筹码。这座数据中心不仅是算力的物理载体,更是中国 AI 产业试图用规模与能源优势弥补制程劣势的集中体现,其成败直接关系到国产算力生态的生死存亡。

荒原上的微光承载着必须成功的宿命。梁文锋在投资人面前掷地有声地说出"必须成功",意味着他亲手烧毁了所有退路。这位极度自负的技术创始人,因受够了中文技术圈跟随硅谷拾人牙慧的处境,决心通过自主可控证明中国 AI 的实力。从订单落地、产线排期到机房通电,整个周期长达一年半,最终交付量取决于上游脆弱的制造良率,无人能打包票。内蒙古草原深处,16 万颗芯片将在西北风沙中依次点亮。这些微弱的指示灯在浩瀚草原面前依然渺小,如同几年前杭州深夜机房里的萤火。但在漫长的技术突围周期里,灯必须被点亮。这 16 万点微光最终是连成通明的一片,还是被大风吹散,只能交由时间给出答案。这是继半导体封锁之后,中国科技产业在 AI 底层基础设施上发起的最为悲壮也最为关键的一次突围。

评论

回复 @用户
0/800

暂无评论

消息提醒

登录后查看消息
查看全部消息管理订阅