来源:环球网
【环球网科技报道 记者 王楠】9月21日,2026人工智能计算大会(AICC2026)在北京中关村国际创新中心举办。浪潮信息在大会上发布元脑SD200 Ultra超节点AI服务器与元脑HC2000多元算力机组。浪潮信息首席AI战略官刘军在大会期间表示,智能体的发展,让智能有望像计算和电力一样,成为可以被规模化生产和供给的资源。

刘军提出,Agent时代的AI计算正在形成两个同样重要的发展方向:Capability AI Compute,即能力型智算,支撑突破智能上限,让AI帮助人类探索未知、解决过去解决不了的问题;Capacity AI Compute,即容量型智算,实现智能充分供给,让高水平智能越来越丰富、越来越经济、越来越易于获取。
“能力型智算着眼于智能能够达到的高度,支撑人工智能解决过去解决不了的问题。而智能的价值还取决于有多少人能够获得它,这也是容量型智算的意义:通过效率提升和成本下降,让更多人和企业用得起、用得上。正如稳定、廉价的电力进入千家万户,智能也应从稀缺资源逐步成为整个社会都能获得的基础能力。”刘军说,为此,需要以贯穿式系统创新提升计算效率,以开放创新汇聚产业力量,让智能能力的突破与智能供给的扩大同步推进。
本次发布的元脑SD200 Ultra超节点AI服务器基于本土AI芯片,单机承载运行2.8万亿参数的Kimi K3大模型,Token生成时延首次突破5.85毫秒,相当于单用户速度 170 Tokens/s,达到业界平均水平的5倍。该产品以开放系统设计紧耦合128芯本土AI芯片,采用3D Hyper Mesh架构,提供8TB统一编址显存和64TB内存,支持10万亿参数规模前沿模型单机运行。依托全局统一寻址、对称直连、超级算子等技术优化,大幅降低通信开销,提升大模型推理性能。同期亮相的元脑HC2000多元算力机组,采用DirectCom 2.0极速架构,基于高密液冷AI整机柜、搭配MCIS推理软件栈,实现计算负载按需匹配、动态优化,同等投资Token产能提升10倍。
刘军认为,Agent的快速普及正在重塑基础设施。多轮推理、长上下文、工具调用和多智能体协作,使计算瓶颈从单一算力环节进一步延伸至存储、互连、调度和软件栈,推动AI计算从单点优化走向面向真实负载的全栈协同。面向能力型智算与容量型智算两类需求,计算系统需要以大模型和Agent负载为牵引,统筹算子、内存、互连与整机系统,从局部优化走向贯穿式系统创新。
大会上,工业和信息化部电子第五研究所联合多家机构发布面向Agent时代的“可靠 AI”测评体系;IDC与浪潮信息联合发布的报告预测,2026年中国智能算力规模将达到2576.5 EFLOPS,同比增长87.9%。
“未来我们将围绕前沿模型和Agent的实际需求,持续推进贯穿式系统创新,让更强的智能能力以可负担的成本进入更多企业和行业应用。”刘军说。