文章摘要
本文围绕华为昇腾与DeepSeek的合作展开。2024年双方开始交流合作,2025年春节期间,DeepSeek用户量爆发,华为紧急调配资源,助其完成模型部署与验证。此后华为持续提供技术支持。2025年8月5日昇腾计算产业发展峰会召开,宣布CANN全面开源开放,标志着昇腾迈向规模化应用,推动国产AI产业发展。

DeepSeek 的爆发与昇腾的深度绑定,远比外界想象的更加紧密。

2025年初的春运返乡潮中,一列高铁正穿梭在冬日的铁轨上。车厢里满是归心似箭的旅客,一名华为云技术人员却无暇休息,他挤过拥挤的座位区,靠着洗手台寻找电源插座——高强度的连续会议已经让手机电量濒临耗尽。耳机里传来远程会议的紧凑发言,工作群的消息不断跳动,他一边记录核心部署,一边切换远程界面监控数据流量,语速飞快地协调指令,生怕列车驶入信号盲区错过关键安排。动车的轰鸣、广播声与旅客的交谈声交织,却丝毫没有打乱他的专注。

会议结束后,华为与硅基流动的技术团队全员投入紧急协同,不少华为员工刚结束出差在机场、刚返乡与家人团聚,甚至已经在海外休假,都立刻回归岗位,投入这场“技术救援”行动。

1月28日上午的紧急会议上,华为高层迅速拍板,要求华为云全力支持DeepSeek:一方面,昇腾与DeepSeek此前已有联创合作基础,具备快速对接的条件;另一方面,可快速调动高性能昇腾芯片承接暴涨的访问流量,同时依托全球云节点、存算网络与安全防护能力,为DeepSeek App的全球稳定运行提供全方位技术保障。

华为云团队敏锐察觉到,DeepSeek正在重塑全球AI竞争格局,即便当时DeepSeek尚未直接使用昇腾算力,也需要先完成云上对接。为此,海思、华为云等多个团队抽调230余名技术骨干,组建总体架构、资源供给、昇腾算子、模型调优、业务运维五个攻坚小组。华为云贵安数据中心紧急开通1024张昇腾910B芯片,机房内红蓝指示灯交替闪烁,仿佛在等待一场技术突破的洗礼。华为技术团队协助硅基流动完成DeepSeek-V3模型的端到端推理流程,并完成性能与精度的初步验证。

从除夕夜到大年初二,双方团队昼夜奋战,完成了3000余张昇腾芯片的部署与验证,最终将DeepSeek-V3/R1大模型成功部署到华为云贵安数据中心的昇腾云上,点亮了国产算力与国产大模型协同的灯塔,为国产算力支持自主大模型开辟了道路。

2025年春节期间,DeepSeek的用户量迎来爆发式增长,全球海量用户涌入,猛烈冲击着服务器集群,打破了“美国AI不可超越”的行业认知。华为首席科学家廖恒曾评价:“DeepSeek是一个极具突破性的奇迹。”

这场技术冲击波完全超出了预期,DeepSeek创始人梁文锋此前并未预料到春节期间的流量暴涨,尽管他始终坚信通用人工智能的发展方向,对团队的技术实力充满信心。国内不少大模型团队曾陷入“为何我们没能做到”的自我怀疑,但这种情绪很快转化为追赶的动力——短短1-2个季度后,DeepSeek的训练方法与模型结构就成为国内众多大模型团队的学习范本,一场由DeepSeek引发的技术竞赛,推动整个中国AI行业加速向前。

春节过后,DeepSeek的用户热度持续攀升,华为云工程师持续为其提供技术支持,完成数据库扩容与负载优化,保障服务稳定运行。同时,团队也在探索进一步提升模型推理效率的方案,甚至规划推出性能可对标行业顶尖水平的超节点集群,坚信昇腾云将成为中国AI领域的核心支撑。

昇腾与DeepSeek联动的力量,构建生态思维

这场深度合作的伏笔其实早在2024年就已埋下。当年夏天,上海的一间会议室里,华为海思的技术团队与DeepSeek创始人梁文锋展开了首次深度交流。梁文锋身着朴素的运动装与运动鞋,背着双肩包,如同普通工程师般低调,与周围的商务氛围格格不入,但他对技术的专注与深刻理解,让双方迅速建立了信任。

接下来的几个月里,昇腾团队与梁文锋保持高频线上沟通。2024年9-10月,华为向梁文锋展示了昇腾A3 SuperPoD超节点架构,重点介绍了自研互联协议“灵衢”带来的高效通信能力,梁文锋对此表现出浓厚兴趣,认为该架构能够突破传统GPU集群的带宽瓶颈。

2024年11月末的一个寒夜,一通电话打破了宁静:梁文锋主动提出,将即将发布的DeepSeek-R1模型部署到昇腾A3 SuperPoD上,并愿意开放源代码携手创新。DeepSeek团队内部评估后认为,华为的A3架构,尤其是通信优化设计,完全契合自身的技术布局。DeepSeek采用的稀疏专家模型(MoE)包含256个专家单元与32个共享专家单元,总计288个专家,需要极高的计算调度与通信效率,而华为384超节点架构刚好能在单卡容纳全部专家单元,剩余资源还可用于冗余专家复用,加上华为自研的低延迟通信技术,完美匹配该模型的需求。

廖恒立刻意识到这通电话的分量,挂断后立即向高层汇报。寂静的走廊里,他的脚步声仿佛在宣告一场行业变革的到来。华为高层迅速意识到这一合作的战略价值,商务团队快速推进合规流程,统筹调动全储备资源,技术团队则连夜对A3 SuperPoD进行最后的适配调试,实验室里的工程师们紧盯屏幕,指尖在键盘上飞速敲击。

2024年12月3日晚,广州一家酒店的会议室里,暖黄灯光洒在大理石地面上,咖啡香气弥漫。华为团队提前抵达,原本计划与梁文锋共进晚餐,但因行程紧凑,团队先在服务区用餐,随后围坐长桌等待。梁文锋依旧低调现身,直接切入技术合作细节,没有多余客套。双方围绕技术优化展开深入讨论,梁文锋提出了极具挑战性的目标:将昇腾A3 SuperPoD的性能提升至100PFLOPS。这个数字让在场的华为技术专家既惊讶又振奋,一位工程师低声重复着目标,眼神里满是斗志:“这是前所未有的高度,但我们有信心完成!”梁文锋点头,似乎早已预料到这样的反应。

随着讨论深入,双方敲定了技术联创的具体方向:华为团队针对昇腾A3 SuperPoD提出优化方案,梁文锋则从模型层面给出建议,确保DeepSeek-R1能最大化发挥昇腾架构的性能优势。数小时的热烈讨论过后,会议结束,梁文锋合上笔记本,背起背包简单道别后离开,身影消失在酒店大堂。

2025年1月20日,DeepSeek-R1全球发布,这款高性能开源模型迅速引发全球关注,随之而来的是远超预期的访问热潮。从1月22日起,DeepSeek应用的使用量呈几何级增长,海量流量冲击服务器,远超系统承载上限。梁文锋曾坦言:“我们真正的挑战从来不是资金,而是高端芯片的出口禁令。”

危机时刻,华为成为DeepSeek最坚实的后盾。高层紧急会议后,直接要求海思与华为云全力保障DeepSeek的服务。当数万用户持续涌入时,华为的算力支撑如同风暴中的灯塔,为团队稳住了阵脚。DeepSeek团队逐步恢复平稳服务后,华为团队仍在持续优化。梁文锋并不追求独占荣耀,更希望看到整个AI生态共同成长,华为云工程师有条不紊地完成数据库扩容、负载均衡优化,用国产算力支撑国产创新。

在国产算力与大模型携手破局的趋势下,行业格局迎来深刻变革。MoE模型逐渐成为技术主流,大量研发力量转向该路线,行业推理端迎来全面爆发。华为顺势面向运营商、金融、电力、医疗等多个关键行业推出AI一体机,这一波行业普及浪潮,很大程度上正是由DeepSeek的突破带动的。

DeepSeek的成功让中国开源大模型驶入发展快车道,国内研发团队通过互相学习、共享经验,加速了技术迭代,推动了生态共建,形成了正向循环。这不仅是中国软件发展史上的标志性事件,更是中国在基础软件架构与核心算法领域首次获得全球业界的广泛认可,用技术突破赢得了国际尊重。

这场由DeepSeek引领的技术突破并非偶然,而是源于双方长达一年多的深度协同。2026年DeepSeek规划开源新一代大模型后,核心研发团队便启动与DeepSeek的技术对接。在DeepSeek V4预览版2026年4月24日正式开源前,华为就已向DeepSeek研发团队提供昇腾950超节点设备,开展前期适配验证。经过一年多的深度沟通与技术磨合,梁文锋最终决定将昇腾平台作为核心算力底座之一。DeepSeek选择昇腾的核心逻辑,在于希望获得华为提供的芯模协同全栈解决方案与全链路技术保障,本次合作中,DeepSeek将深度使用华为神经网络计算架构(CANN)、昇腾超节点集群等核心技术。

从被动应对算力封锁,到主动构建技术协同,国产算力与大模型的深度融合,为中国AI产业打开了通往自主可控的全新大门,最终将形成更开放、更包容、更具韧性的国产AI开源生态。多年后回望这段产业突围的历程,它如同风暴中的灯塔,不仅照亮了国产大模型的自主前行之路,更指引着中国AI生态从跟跑到并跑,再到引领全球的未来方向。国产算力与国产大模型的协同共生,将成为中国AI产业突破外部封锁、实现自主可控的光辉篇章,点燃无数技术创新与产业落地的梦想,让中国AI的星辰大海愈加通明辽阔。

2025年8月5日,昇腾的历史转折点

2025年8月5日,昇腾计算产业发展峰会正式召开,这场峰会承载着多重意义:一是回应产业界的诉求,华为需要向行业给出明确反馈;二是坦诚正视自身的不足;三是清晰传递华为的战略决心,公布具体的落地计划,而非空泛的承诺;而最重要的一点,是华为将在峰会上宣布CANN全面开源开放。

峰会由高管主讲,会前一天他还和专家们开玩笑:“你们怎么写我就怎么读,但当着产业界说出来的内容,必须在限定时间内落地,搞不定就自己‘提头来见’。”产业客户的真实诉求推动了华为的开放决策:此前不少客户反馈,华为的开放程度不足,不仅制约了自身技术迭代,也放缓了双方协同创新的步伐。这份来自一线市场的声音,与产业界对开放生态的期盼高度契合,进一步坚定了华为开源开放的决心。

峰会当天的演讲堪称一场干货满满的思想盛宴,主讲人从华为布局AI的战略抉择讲起,深入剖析技术架构的演进历程,阐释了先聚焦性能突破、再攻克应用落地的发展路径。整场演讲持续一个多小时,讲口干了就喝水,出汗了就脱掉西装,将积攒多年的思考和盘托出,赢得了在场客户的高度认可,相关技术负责人对此也极为推崇。

这场峰会标志着华为整体战略的转变,昇腾产品正式迈向规模化应用落地,获得了公司高层的全面认可,此前有关金融产品的认知分歧也在峰会上得到了充分讨论。这场峰会在华为的发展历程中留下了浓墨重彩的一笔。

以上内容不代表本平台立场,仅供读者参考