单token生成8.9毫秒,每百万token成本跌破1元,AI产业化迎来算力成本革命。
9月26日,在2025人工智能计算大会上,浪潮信息公布两项突破性进展:基于元脑SD200超节点AI服务器,DeepSeekR1大模型token生成速度仅需8.9毫秒,创造国内大模型最快token生成速度。
同时,最新发布的元脑HC1000超扩展AI服务器,实现每百万token成本首次击破1元。这两项突破旨在解决智能体产业化面临的交互速度和token成本两大核心瓶颈。
速度突破
元脑SD200带动国内AI服务器token生成速度率先进入“10毫秒时代”。这一突破得益于其创新的多主机低延迟内存语义通信架构。该架构在单机内实现了64路本土AI芯片的高速统一互连,单机可承载4万亿参数单体模型,或部署多个万亿参数模型组成的智能体应用。为实现极低的通信延迟,元脑SD200采用精简高效的三层协议栈,原生支持多种内存语义操作,避免冗余数据拷贝,将基础通信延迟降至百纳秒级。
成本革命
浪潮信息同步发布的元脑HC1000超扩展AI服务器,聚焦解决智能体产业化的另一个关键瓶颈——token成本。基于全新开发的全对称DirectCom极速架构,元脑HC1000采用无损超扩展设计,聚合海量本土AI芯片、支持极大推理吞吐量。该服务器通过全面优化降本和软硬协同增效,创新16卡计算模组设计、单卡“计算-显存-互连”均衡设计,大幅降低单卡成本和每卡系统分摊成本。据测算,元脑HC1000通过算网深度协同、全域无损技术,实现推理性能相比传统RoCE提升1.75倍,单卡模型算力利用率最高提升5.7倍。
产业前景
智能体产业化的核心三要素是能力、速度和成本。其中模型能力决定了智能体的应用上限,交互速度决定了智能体的商业价值,token成本决定了智能体的盈利能力。浪潮信息对AI计算架构的持续创新,旨在为多智能体协同与复杂任务推理的规模化落地,提供高速度、低成本的算力基础设施。未来,智能体带来的推理算力需求将呈现出指数级的爆发式增长。
算力成本壁垒的打破,为人工智能技术在千行百业的深度融合铺平了道路。智能体产业化不再受限于响应速度和运营成本,AI技术转化为生产力和创新力的步伐正在加速。
免责声明:本文仅代表作者个人观点,与时尚科技网无关。其原创性以及文中陈述文字和内容未经本站证实,对本文以及其中全部或者部分内容、文字的真实性、完整性、及时性本站不作任何保证或承诺,请读者仅作参考,并请自行核实相关内容。
本网站有部分内容均转载自其它媒体,转载目的在于传递更多信息,并不代表本网赞同其观点和对其真实性负责,若因作品内容、知识产权、版权和其他问题,请及时提供相关证明等材料并与我们联系,本网站将在规定时间内给予删除等相关处理.

