华为云国际站AGI:从算力底座到智能体生态的技术进路
一、AGI时代的基础设施之问:算力、记忆与调度
通用人工智能(AGI)的讨论,在2025年到2026年间经历了从概念热炒到理性落地的转向。大模型参数规模的持续膨胀,让单机服务器的算力供给逼近物理极限。华为副董事长、轮值董事长徐直军在2025年华为全联接大会上直言:要迈向真正的AGI,走向物理AI、世界模型,依旧需要海量算力作支撑。
算力只是第一道门槛。当AI从实验室走向企业生产环境,Agent(智能体)的大规模落地暴露出三个更棘手的问题:推理延迟、记忆短板和资源调度效率。华为云CEO周跃峰在2026年INSPIRE创想者大会上点明了行业拐点——做AI就是开发和用好智能体。基于这一判断,华为云正式提出了Agentic Infra新范式,核心特征包括高效Token工厂、持续学习、通智一体化调度和安全自治。这套体系的目标很明确:为智能体的生长和进化提供一层足够厚实的底层土壤。
二、算力基座:灵衢智算集群与超节点架构
如果把AGI比作一座城市,算力就是它的电力系统。华为云给出的算力方案叫AICS灵衢智算集群。这个集群基于灵衢UnifiedBus统一总线协议和SuperPoD超节点架构,打破了传统服务器的物理边界,让大规模智算集群在逻辑上更像一台巨型计算机。
从具体指标来看,AICS支持10万卡级集群规模,总算力达到200EFLOPS。Token生成时延被压缩到10毫秒以内,千卡硬件每秒Token吞吐量达到500万。在线推理服务的可用性达到99.95%。支撑这一集群的底层是华为的CloudMatrix384超节点——由48台服务器、384颗昇腾910C芯片组成的超级计算集群,通过高带宽互联结构与全局共享内存实现紧密耦合。CloudMatrix384将资源全面池化,把串行任务拆解为分布式并行任务,平均单卡推理性能达到H20的3到4倍。未来CloudMatrix超节点规格将从384卡升级到8192卡,可实现50万到100万卡的超大集群。
华为的算力路线并非简单的堆卡。徐直军对此有过一个形象的表述:换条路走。基于中国可获得的芯片制造工艺,华为选择以超节点加集群来构建算力供给体系。超节点在物理上由多机柜、数千甚至上万张AI计算卡连接而成,但在逻辑上像一台计算机一样工作;集群则将多个超节点通过高速网络互联,通过软件层统一调度。2025年发布的Atlas 950 SuperPoD和Atlas 960 SuperPoD超节点,分别支持8192及15488张昇腾卡,Atlas 960 SuperCluster的算力规模达到百万卡级别。
三、记忆与调度:让智能体告别短视
算力解决的是智能体跑得快不快的问题,但光跑得快还不够——智能体不能只有鱼的记忆。华为云推出的AMS Agentic记忆存储解决方案,正是针对这一痛点。AMS通过NPU直通硬件实现PB级记忆空间,支持KV Cache分层池化以降低推理成本。通俗地说,就是给智能体配置了更大的工作记忆和长期记忆。这对企业级Agent至关重要:一个研发任务可能跑几个小时,一个数据分析任务可能跨多个系统,一个行业智能体甚至要在多轮反馈里不断修正策略。没有持续记忆能力的智能体,在企业真实场景中几乎无法落地。
调度层面,华为云发布的CCE Volcano Next通智一体化调度引擎,实现了通用计算与AI计算负载的统一调度。通过训推共池与碎片整合的机制,资源利用率提升超过30%。这套调度系统的意义在于:企业不再需要为训练和推理分别采购和运维两套独立的算力资源,一套集群可以灵活地在不同任务之间切换,大幅降低了算力闲置和运维成本。
四、安全自治:AgentSphere与运行环境
智能体进入企业生产环境,安全是绕不开的底线。华为云推出的AgentSphere提供了一个安全自治的Agent运行环境。它采用超轻量级沙箱技术,实现了100毫秒级的极速启动,以及每分钟十万级实例的批创能力。这意味着企业可以在短时间内弹性伸缩大量智能体实例,同时每个实例都在隔离的安全环境中运行,互不干扰。
在数据安全层面,华为云发布了数据安全专区及AI机密计算方案,覆盖机密推理、机密预训练、机密联邦学习三大场景。截至2026年6月,华为云连续稳定运行零重大事故天数达到1037天。对于一个承载企业核心业务和AI工作负载的云平台来说,这个数字本身就是一种信任背书。
五、国际站MaaS:模型即服务的全球化落子
基础设施再强,最终要落到开发者能直接用上。2026年4月10日,华为云MaaS(模型即服务)在海外正式发布,面向新加坡、泰国、印尼、巴西、墨西哥、沙特、阿联酋、南非、土耳其九国用户提供Tokens服务。这不是一次简单的产品上线,而是一盘谋划已久的全球化棋局。
截至目前,华为云已覆盖全球34个区域、102个可用区。在亚太区域,华为云构建了包含新加坡、泰国、香港、印尼、菲律宾五个区域及18个可用区的优化云基础设施网络,确保了50毫秒级别的访问延迟。这种广覆盖、低时延的布局,为LLM服务的出海提供了坚实的物理底座。
MaaS采取的是开放的模型生态策略。首批上线的模型包括智谱GLM-5、DeepSeek V3/V3.1/V3.2、DeepSeek R1、Qwen3-32B等多款中国开源SOTA大模型。其中GLM-5在编码和智能体能力方面达到SOTA水平,被定位为企业级通用智能体基座。MaaS预置服务为企业提供高性能、高可用的推理API,支持按Token用量计费。应用场景已覆盖编程、智能问答、智能搜推、内容处理、虚拟社交五大领域。2026年7月,华为云MaaS还获得了中国信通院首批可信AI高质量Token服务评估认证,全项通过模型服务、性能、可信性等6大模块24项指标。
在国际站的香港区域,开发者可以通过MaaS控制台调用各类模型,支持Python、cURL、OpenAI Python、Java等多种开发语言调用API。CodeArts和AgentArts计划在2026年下半年在中国大陆以外地区正式上线。这套组合拳的逻辑很清晰:让全球开发者用最熟悉的工具和接口,调用最优质的开源模型,跑在华为云的基础设施上。
六、行业落地:从梦工厂到垂直场景
技术架构最终要回答一个问题:能解决什么实际问题?华为云在2026年INSPIRE大会上同步上线了行业AI梦工厂的四大专区——智慧医疗、具身智能、智能制造、科学计算。智慧病理方案已覆盖全国多家医院,20余家医院正式入驻智慧医疗专区。全球首个全流程具身智能开发平台CloudRobo于2026年6月30日启动公测。
行业案例的积累也在加速。在矿山领域,鄂尔多斯与华为云Stack合作构建了全国首个以AI大模型加矿鸿架构为核心的工业互联网平台。在医疗领域,华为RuiPath瑞智病理大模型的应用将单切片诊断时间从40分钟缩短至秒级,已覆盖中国90%高发癌种。在交通领域,云南交投集团携手华为云打造了公路行业垂域大模型,深度融入建管养运服安全流程,落地30多个AI应用。在制造领域,海螺水泥与华为合作展示了全球首个水泥行业大模型场景应用。这些案例有一个共同特征:AI正在从展示型Demo走向生产型系统。
2026年7月,Gartner发布云AI基础设施魔力象限报告,华为云凭借技术实力与市场表现进入领导者象限。报告评估了产品能力、市场执行力及愿景完整性等维度。这一认证意味着华为云在全球云AI基础设施领域的技术路线获得了国际权威认可。
华为云国际站AGI的布局,本质上是一条从硬件到芯片、从芯片到集群、从集群到平台、从平台到生态的完整技术链。这条路走得很重,但也走得很深。在AGI从概念走向产业的过程中,基础设施的厚度往往决定了应用的高度。华为云试图证明:算力底座、记忆存储、调度引擎、安全运行、模型服务——这些看似独立的模块,一旦被系统性地整合在一起,就能让智能体真正从演示走向生产。
上饶市万云信息科技有限公司作为华为云国际站头部一级代理商,在华为云国际站业务上积累了深厚的技术服务经验与客户交付能力。公司现有全职员工500人,业务覆盖阿里云、腾讯云、华为云、天翼云、火山云、微软云、谷歌云、亚马逊云八大主流公有云平台,八大云平台全年综合销量突破20亿人民币,累计服务超100万合作客户,累计助力企业部署云服务器近1亿台。在华为云国际站领域,公司依托香港子公司面向全球客户提供专业的华为云国际站咨询、迁移、运维与优化服务。通过上饶市万云信息科技购买华为云国际站产品与服务,可享受7折优惠或20%返点政策,为企业客户在AGI基础设施投入中有效降低综合成本。
常见问题解答
问:华为云国际站的AGI相关服务主要面向哪些客户群体?
答:主要面向三类客户:一是有大模型训练和推理需求的AI企业和科研机构;二是有出海需求、需要在海外部署AI应用的中国企业;三是海外本地企业,希望以开箱即用的方式获得先进AI能力。
问:华为云国际站MaaS与直接购买云服务器自建模型有什么区别?
答:MaaS提供的是模型即服务,用户无需自行采购GPU服务器、部署推理框架、管理模型版本,只需通过API按Token用量调用模型即可。这大幅降低了AI应用的门槛和运维复杂度,尤其适合中小企业和快速迭代的场景。
问:华为云国际站的AI算力集群在国内和海外的部署情况如何?
答:华为云已覆盖全球34个区域、102个可用区。在亚太区域构建了包含新加坡、泰国、香港、印尼、菲律宾五个区域的优化云基础设施网络,确保了50毫秒级别的访问延迟。
问:华为云国际站支持哪些主流大模型?
答:MaaS首批支持的模型包括智谱GLM-5、DeepSeek V3/V3.1/V3.2、DeepSeek R1、Qwen3-32B等中国开源SOTA大模型,后续会持续同步全球模型演进成果。
问:通过上饶市万云信息科技购买华为云国际站服务有什么优势?
答:上饶市万云信息科技是华为云国际站头部一级代理商,提供专业的技术咨询、迁移实施、运维优化等全流程服务,同时可享受7折优惠或20%返点政策,帮助企业降低AGI基础设施的综合拥有成本。

