2026年开放计算技术大会;浪潮信息;重构Agent基础设施

2026年开放计算技术大会在京举行 浪潮信息重构Agent基础设施

7月9日,2026年开放计算技术大会(OCTS 2026)在北京举行。作为中国开放计算领域生态覆盖最广、最具影响力的年度技术盛会,本届大会汇聚超50家全球领先AI创新企业与产业上下游力量,聚焦AI基建新前沿,共同探讨产业创新突破路径。

大会上,浪潮信息副总经理赵帅发表了题为《打造领先Agent基础设施,加速产业AI转型》的演讲。会后接受媒体群访时,赵帅与浪潮信息技术专家进一步阐释了AI基础设施如何应对从单次模型调用向海量Agent持续运行演进的结构性变革。

赵帅在演讲中援引IDC数据指出,2025年至2028年,中国Agent企业级市场年复合增长率预计超过110%;Gartner预测,2026年将有40%的企业应用集成AI Agent。在制造业,生产Agent已将氧化铝生产效率提升60%、能耗降低3.6%;在研发领域,AI Coding Agent将开发周期压缩70%以上。Agent正从娱乐式对话加速融入制造、机器人、汽车、编程等真实生产场景。

Agent规模化催生基础设施重构

赵帅指出,Agent与以往对话式AI推理存在本质差异。以前主要在GPU上运行大模型AI推理,而现在Agent需要将任务拆解为多层次、多类型、多逻辑的需求链,涉及需求拆解、工具调用、多轮协作等环节。每个Agent本质上运行在一个CPU沙箱环境中,承担大量逻辑处理、流程与资源管理、系统协同等工作。这对计算资源的需求与大模型推理截然不同,需要更高可用性的架构、更高密度的CPU算力资源以及全链条安全合规保障。

“Agent的规模化本质是一次系统工程的规模化,”赵帅在演讲中表示,“CPU服务器作为Agent运行底座的核心价值,是让越来越多的Agent能够在企业里长期运行、并发协作,并始终保障安全可控。”

CPU原生液冷整机柜服务器:单柜384颗处理器、4万+Agent并发

针对Agent运行对CPU服务器算力密度和散热能力的全新要求,浪潮信息发布了面向“群智协同”的CPU原生液冷整机柜服务器。

该产品基于开放液冷OCM标准,支持X86和ARM等多元算力架构在同一计算底座上协同工作,单柜可支持384颗处理器、4万以上Agent并发,支撑海量智能体高效协同运行。

同时,赵帅在采访中解释了这一产品设计的产业逻辑。当前AI基础设施正经历功耗密度的急剧跃升,AI算力机柜今年预计会达到300千瓦到兆瓦级,CPU服务器也必须做更高密度来适配AIDC的供电和散热基础设施。

在技术细节上,CPU原生液冷整机柜服务器采用领先的原生液冷架构,面向智能体应用,重构CPU计算系统,实现了多项关键技术突破:通过系统解耦与立体化设计,实现计算单元、通信单元和存储单元等模块全域液冷重构,保证极限部署密度的同时,散热能力超前匹配芯片功耗增长;基于液冷OCM(开放计算模组)架构构建,支持多元算力灵活组合,单柜可集成业界最高密度384颗CPU,支持4万+ Agent高并发运行;无线缆设计,支持全生命周期带液热维护、业务零中断,运维效率提升150%以上,面向未来GW级AIDC演进需求,为企业Agent提供高密、高效、绿色的算力资源支撑。

超节点引擎:5毫秒Token生成与多模融合

在Agent的“思考”端——Token生产引擎方面,浪潮信息展示了元脑SD200开放超节点AI服务器系列的最新进展。赵帅介绍,经过持续软硬协同优化,元脑SD200在Kimi K2.6万亿参数模型上的单Token生成时间已缩短至4.77毫秒,成为国内超节点系统中首个突破5毫秒大关的产品。更重要的是,元脑SD200单机提供4TB统一显存空间,可同时驻留多个主流万亿参数大模型,支持多模型并行推理、评审和融合。

浪潮信息在元脑企智EPAI平台上开展的“多模融合”实践验证显示,融合模型在深度研究测试中以53.9%取得最佳成绩,在AIME2026数学推理和GPQA Diamond高难问答中分别以97.2%和90.8%全面领先单一模型。

赵帅在采访中强调,“多模融合”并非将全部任务都交给多个万亿模型处理。元脑企智EPAI平台通过智能路由实现任务分级调度——简单问答由轻量模型快速响应,复杂逻辑推理和代码生成则由融合模型处理。技术专家补充,这种分级调度机制将Token消耗控制在可控范围内,同时减少反复试错带来的浪费,综合成本反而更可控。

为使超节点能力惠及更多企业用户,浪潮信息将元脑SD200核心技术路线延伸,推出企业版本。该版本基于Open Fabric Switch支持16个AI加速卡统一Scale-up计算域,实现统一寻址和低时延跨卡通信,万亿参数推理TTFT降低40%以上,可支持国内主流万亿参数开源模型的本地部署,大幅降低企业应用智能体的适配和成本门槛。

行业趋势:CPU+GPU协同成为新范式

针对Agent时代CPU与GPU角色变化的行业讨论,赵帅表示,GPU在未来十年依然非常重要,决定了模型能力的天花板;而多Agent协同通过工程化手段提升模型输出质量,多模融合则从技术层面打破智能上限。CPU负责任务拆解、信息查询、决策分析等逻辑密集型环节,GPU负责前向推理和Token生成,两者协同推动Agent基础设施的重构。

在供电与数据中心基础设施层面,赵帅透露,800V直流供电进机柜是必然趋势。兆瓦级机柜带来供电链路的根本性变革,800V高压直进机柜将重构数据中心供电架构。浪潮信息已在算电分离、Busbar供电、固态变压器等前沿技术方向进行布局,为吉瓦级智算中心时代的到来储备关键技术。

 

(免责声明:本文为本网站出于广告目的进行转载发布,不代表本网站的观点及立场。本文所涉文、图、音视频等资料之一切权力和法律责任归材料提供方所有和承担。本网站对此咨询文字、图片等所有信息的真实性不作任何保证或承诺,亦不构成任何购买、投资等建议,据此操作者风险自担。)

广告等商务合作,请点击这里

本文为转载内容,授权事宜请联系原著作权人。

打开界面新闻APP,查看原文
界面新闻
打开界面新闻,查看更多专业报道

热门评论

打开APP,查看全部评论,抢神评席位

热门推荐

    下载界面APP 订阅更多品牌栏目
      界面新闻
      界面新闻
      只服务于独立思考的人群
      打开