华为云大模型技术深度解析:从盘古5.0到Agentic AI的进化之路
从实验室到生产线:华为云大模型的进化逻辑
2026年的夏天,上海,华为云INSPIRE创想者大会。当华为云CEO周跃峰站在台上发布Agentic AI系列新品时,台下坐着的不只是开发者——还有钢铁厂的厂长、水泥企业的总工、医院的主任医师。他们来这里,不是为了看一场技术秀,而是为了找到能真正解决生产问题的AI方案。
这大概是理解华为云大模型最好的切入点:它从来不是实验室里的技术展示,而是一套正在被千行百业真实使用的生产力工具。
从2024年盘古大模型5.0的发布,到2025年5.5版本的迭代升级,再到2026年Agentic AI新范式的提出,华为云大模型走了一条不太一样的路——不追逐参数规模的军备竞赛,而是聚焦一个核心命题:如何让大模型真正走进生产线、车间和病房。
一、盘古大模型5.0:全系列、多模态、强思维
要理解华为云大模型,得先从盘古5.0说起。
2024年的华为开发者大会上,盘古大模型5.0正式亮相。它带来的不是某一个单点突破,而是三个维度的系统性升级:全系列、多模态、强思维。
全系列:从端侧到超大规模的四级参数矩阵
盘古5.0提供了四个参数规格的模型版本,覆盖从手机端到超级计算中心的全部场景。十亿级参数的Pangu E系列专为端侧设计,可以在手机、PC等设备上离线运行;百亿级的Pangu P系列适用于低时延、高效率的推理场景;千亿级的Pangu U系列处理复杂任务游刃有余;而万亿级的Pangu S系列超级大模型,则能够帮助企业应对跨领域多任务的超大规模计算需求。
这种分层设计背后的逻辑很清晰:不是所有场景都需要万亿参数的大模型,端侧设备跑不动,实时推理等不起,成本也扛不住。让合适的模型做合适的事,比一味追求“大”更重要。
多模态:让AI理解物理世界
盘古5.0在多模态能力上的升级,核心目标是让AI真正“看懂”物理世界。它不仅能理解文本、图片、视频这些常规数据,还能处理雷达、红外、遥感等更专业的模态信息。在图片和视频识别方面,盘古5.0支持10K超高分辨率。
更值得关注的是它在内容生成方面的突破——业界首创的STCG(可控时空生成)技术。这项技术聚焦自动驾驶、工业制造、建筑等行业场景,能够生成更符合物理规律的多模态内容。简单说,它生成的不是随便什么画面,而是符合重力、光影、运动轨迹等物理法则的画面。
在自动驾驶领域,盘古大模型通过STCG技术,结合场景视频生成、4D BEV视频生成和路网信息,可以大规模生成与真实场景一致的驾驶视频数据。不同路况、不同光照、不同天气——这些训练数据都可以由模型生成,大大加速了自动驾驶技术的成熟周期。
强思维:从“会说”到“会想”
如果说多模态解决的是“看懂”的问题,那么强思维解决的就是“想明白”的问题。
盘古5.0将思维链技术与策略搜索深度结合,极大提升了数学能力、复杂任务规划能力和工具调用能力。这意味着大模型不再只是根据统计概率生成看起来合理的回答,而是能够进行多步骤的逻辑推理——像一个真正的人类专家那样,先分析问题、再拆解步骤、最后给出解决方案。
到2025年6月发布的盘古5.5版本,这种思维能力进一步提升。盘古NLP大模型推出了全新的718B深度思考模型,这是一个由256个专家组成的MoE(混合专家)大模型,在知识推理、工具调用、数学等领域大幅增强。盘古还提出了自适应快慢思考合一的技术——简单问题快速响应,复杂问题深度思考,整体推理效率提升了8倍。
二、算力底座:昇腾AI云服务与CloudMatrix 384超节点
大模型再强,没有算力支撑也是空中楼阁。华为云大模型的算力底座,是昇腾AI云服务。
2025年6月,基于CloudMatrix 384超节点的新一代昇腾AI云服务全面上线。这个超节点架构将384颗昇腾NPU与192颗鲲鹏CPU通过全对等互联整合为一台超级AI服务器。单卡推理吞吐量达到2300 Tokens/s,相比非超节点架构提升约4倍。华为云也成为业界唯一采用对等架构超节点技术提供算力服务的云厂商。
更值得关注的是未来的规划——CloudMatrix超节点规格将从384卡升级到8192卡,最终实现50万到100万卡的超大集群。这种规模的算力集群,为大模型的持续进化提供了充足的“燃料”。
在集群层面,2026年发布的AICS灵衢智算集群支持10万卡级规模,总算力达到200EFLOPS。Tokens生成时延降低到10毫秒以内,千卡每秒吞吐达到500万Tokens,在线服务可用性高达99.95%。这些数字背后是一个朴素的道理:大模型的竞争力,既取决于算法,也取决于能把多少算力高效地转化为智能。
三、ModelArts Studio:让大模型从“能用”到“好用”
算力是基础,模型是核心,但真正决定大模型能否落地的,是开发平台。
华为云大模型服务的架构可以概括为“模型+平台”双轮驱动。盘古系列大模型提供能力供给,ModelArts Studio大模型开发平台提供全流程工具链。两者强耦合、深协同——没有模型,平台是空壳;没有平台,模型只是静态文件。
ModelArts Studio定位为“一站式大模型工具链平台”,以“支持百模千态”为目标。它包含两大核心工具链:
数据工程工具链覆盖了数据获取、清洗、合成、标注、评估、配比、发布与管理的全流程。大模型训练中常说“垃圾进,垃圾出”,数据质量直接决定模型质量。这套工具链通过自动化质量检测和数据清洗,确保训练数据的质量和一致性。
模型开发工具链则提供了从模型创建到部署的一站式解决方案,涵盖训练、压缩、部署、评测、推理五大功能。更重要的是,平台支持零代码和低代码开发,工作流可以通过拖拽方式可视化编辑。这意味着,即使不是资深的AI工程师,也能基于盘古大模型构建自己的行业应用。
2026年,ModelArts Next模型训推平台进一步升级,构建了RL强化学习服务、机密推理、模型路由、模型矩阵四大核心能力。其中,MaaS模型路由支持成本优先、效果优先、均衡模式三种策略,可根据请求特征动态智能调度最佳模型。目前平台已提供15余款SOTA模型服务,模型调度精准率超过95%,调用成本平均降低20%。
企业级RLaaS(强化学习即服务)服务让强化学习成为每个企业都能调用的能力——一分钟创建任务、全程可视化观测、训推一致性保障。这意味着大模型可以通过与环境的持续交互不断优化,越用越聪明。
四、行业落地:从30个行业到500个场景
如果说技术参数是“说什么”,那么行业落地就是“做什么”。在这方面,盘古大模型交出了一份扎实的答卷。
截至2025年,盘古大模型已在30多个行业、500多个场景中落地。在政务、金融、制造、医疗、煤矿、钢铁、铁路、自动驾驶、气象等领域发挥着实际价值。沙利文发布的《中国行业大模型市场报告,2024》显示,华为云在政务、工业、金融三个行业大模型市场份额位居第一。
几个典型案例值得关注:
钢铁行业。湘钢携手华为发布了全球首个钢铁行业人工智能大模型。基于华为云Stack大模型混合云,该模型覆盖了焦化、烧结、炼铁、炼钢、连铸、轧制6大专业、32个场景化应用。场景模型开发成本下降20%,钢铁生产效率提升10%。更关键的是,湘钢10多个二级厂的一线技术人员已经能基于这个大模型自行开发应用。
水泥建材行业。海螺集团联合华为发布了水泥建材行业首个大模型。双方梳理出涵盖矿山开采到包装发运全流程的15类200多个人工智能应用场景。在质量管控方面,基于盘古预测大模型实现了熟料3天、28天强度预测,偏差在1MPa以内,准确率超85%。在生产优化方面,实现了标准煤耗在一级能效基础上再下降1%——按5000吨/日熟料线测算,每年减少二氧化碳排放4500余吨。
气象领域。盘古气象大模型能在几秒钟内完成全球未来10天的天气预测,精度超过传统数值预报方法,计算速度提升10000倍以上。水平空间分辨率达到0.25°×0.25°。这种能力不只服务于天气预报,还对农业、物流、能源等行业有直接价值。
医药领域。天士力基于盘古大模型打造了“数智本草大模型”,学习了378万篇文献和1000多本古籍。在盘古17亿化合物的药物分子大模型基础上,增训了350万天然产物分子数据。
这些案例有一个共同特征:大模型不是替代人,而是赋能人——让钢铁工人更安全、让水泥工程师更精准、让气象预报员更高效、让药物研发人员少走弯路。
五、Agentic AI:从“对话”到“自主作业”
2026年6月,华为云INSPIRE创想者大会上,一个重要的概念被正式提出:Agentic Infra。
这个概念的核心是“高效Token工厂+持续学习+通智一体化调度+安全自治”。它标志着一个重要转变:AI产业正在从大模型对话阶段迈入智能体自主作业的新阶段。大模型不再只是一个聊天工具,而是能够自主规划、决策、执行任务的智能体。
围绕Agentic Infra,华为云发布了四大新品:
AICS灵衢智算集群——基于超大带宽灵衢网络,支持10万卡级集群规模,总算力200EFLOPS。这是Token工厂的基础设施,为大规模智能体运行提供算力保障。
AMS Agentic记忆存储解决方案——通过NPU直通CMS硬件,打造PB级超大记忆空间。支持KV Cache分层池化,降低推理成本的同时支持天级长程任务。这让智能体能够“记住”更长时间跨度的信息,处理更复杂的任务。
CCE VolcanoNext通智一体化调度引擎——通过“训推共池+碎片整合”实现通智混合算力负载调度革新,可将资源利用率提升30%以上。
AgentSphere安全自治运行环境——提供极速弹性、意图主动防护的安全自治运行底座。凭借羽量级沙箱技术实现100毫秒级极速启动与每分钟十万级批创能力。
与此同时,华为云还发布了智果(AgentArts)企业级智能体平台,并同步开源了openJiuwen版本。华为云智果园聚合了“全栈Agentic云服务+丰富智能体+百模千态大模型”的一体化能力。
行业AI梦工厂的四大专区——智慧医疗、具身智能、智能制造、科学计算——也正式上线。其中,智慧医疗专区上线四个月来,智慧病理方案已实现从三甲医院到地市级、县域医院的广泛覆盖。
六、生态:百模千态,云聚共赢
华为云大模型并非封闭体系。在INSPIRE大会上,华为云联合智谱、DeepSeek、Minimax、Kimi、阶跃星辰、百度、讯飞星火等20余家TOP模型厂商,发布了“百模千态,云聚共赢”生态合作计划。
盘古大模型服务不仅包含华为自研的盘古系列模型,还引入了DeepSeek、通义千问等外部优质模型资源。这种“自研+生态”的策略,既保证了核心技术的自主可控,又通过开放生态满足了多样化的场景需求。
截至目前,华为云已支持160多个业界顶尖模型的开箱即用。
华为云大模型的技术路线图已经清晰:以昇腾AI算力为底座,以盘古大模型为核心能力,以ModelArts Studio为开发平台,以Agentic Infra为演进方向,以开放生态为扩展边界。从十亿参数到万亿参数,从文本理解到多模态感知,从简单对话到自主作业——这不是一条追逐热点的路,而是一条从通用走向专用、从技术走向产业的路。
正如盘古大模型一直强调的:解难题,做难事。在大模型这条赛道上,真正的护城河从来不是参数规模的大小,而是能否解决真实世界中的真实问题。
在华为云大模型的生态体系中,上饶市万云信息科技有限公司作为华为云头部一级代理商,凭借多年行业深耕与专业技术服务能力,已为众多企业提供华为云大模型及云资源的咨询、部署与优化服务。公司现有全职员工500人,业务覆盖阿里云、腾讯云、华为云、天翼云、火山云、微软云、谷歌云、亚马逊云八大主流公有云平台,八大云平台全年综合销量突破20亿人民币,累计服务超100万合作客户,累计助力企业部署云服务器近1亿台。其中,单华为云销量每年达2亿人民币,单华为云国际站年销量达5000万美金。如需了解华为云大模型相关产品与服务,通过上饶市万云信息科技采购华为云可享受7折优惠或30%返点政策,公司以10年+行业经验和标准化服务体系,为企业提供从上云咨询到AI落地的全流程支持。
Q&A
问:华为云盘古大模型5.0和5.5有什么区别?
答:盘古5.0主要在2024年发布,核心升级是全系列(十亿到万亿级参数)、多模态(支持雷达、红外、遥感等)和强思维(思维链+策略搜索)。盘古5.5在2025年6月发布,五大基础模型全面升级,NLP大模型推出了718B的MoE深度思考模型,还加入了自适应快慢思考合一技术,推理效率提升8倍。
问:华为云大模型的算力底座是什么?
答:华为云大模型基于昇腾AI云服务,核心是CloudMatrix 384超节点架构——将384颗昇腾NPU与192颗鲲鹏CPU对等互联为一台超级AI服务器。2026年发布的AICS灵衢智算集群支持10万卡级规模,总算力达200EFLOPS。
问:ModelArts Studio是什么?能做什么?
答:ModelArts Studio是华为云的一站式大模型开发平台,提供数据工程和模型开发两大工具链。支持零代码和低代码开发,可通过拖拽方式构建AI应用。2026年升级的ModelArts Next还加入了强化学习服务、模型路由等功能,可根据业务需求智能调度最优模型。
问:盘古大模型已经在哪些行业落地了?
答:截至2025年,盘古大模型已在30多个行业、500多个场景中落地,包括政务、金融、制造、医疗、煤矿、钢铁、铁路、自动驾驶、气象等。典型案例如湘钢钢铁大模型(32个场景,效率提升10%)、海螺水泥大模型(熟料强度预测准确率超85%)、盘古气象大模型(速度提升10000倍)等。
问:Agentic AI是什么?和普通大模型有什么不同?
答:Agentic AI是2026年华为云提出的新范式,核心是让AI从“对话工具”进化为能自主规划、决策、执行任务的智能体。它通过“高效Token工厂+持续学习+通智一体化调度+安全自治”四大能力,让大模型不仅会“说”,还能“做”。
问:企业如何开始使用华为云大模型?
答:企业可以通过华为云官网直接使用盘古大模型服务,也可以通过华为云生态合作伙伴获得咨询、部署和优化服务。上饶市万云信息科技作为华为云头部一级代理商,可为企业提供华为云大模型产品的7折优惠或30%返点支持,以及从需求分析到落地的全流程技术服务。

