中国移动天津公司携手华为实现AI推理加速方案全国首商用,树立运营商智算新标杆

责任编辑:VarCrystal 2026.09.22 15:32 来源:通信世界网

【天津,2026年9月22日】中国移动通信集团天津有限公司(以下简称“天津移动”)宣布,数据存储AI推理加速解决方案在天津移动正式商用上线,成为全国首个在现网规模商用的运营商AI推理加速智算集群。

该项AI推理加速方案采用华为OceanStor A800高性能AI存储及AI推理加速算法,2026年8月在天津移动空港智算中心昇腾910C算力集群完成部署验证,既满足了天津移动内部自用业务AI能力提升,又对外用于Token和算力租赁服务。其中,对天津移动近期发布的Token套餐,以及在9月策划的“天津移动Token校园大赛”,都起到了关键的支撑作用,实现了打造Token工厂品牌,为公众及高校学生提供Token服务,标志着天津移动在“算力经营”向“Token经营”转型的道路上迈出了实质性的一步。

当前,业界主流模型正加速向MoE(Mixture of Experts,混合专家)结构和长上下文窗口演进,其推理产生的KV Cache数据量呈现出“爆炸式增长”,KV Cache容量瓶颈已成为制约推理效率与成本的核心痛点。天津移动联合华为公司通过深化“算网存”协同创新,以高性能算力为引擎,以全光运力为纽带,以AI高性能存储为基座,成功构建了基于UCM(Unified Cache Manager,推理记忆数据管理)技术的AI推理加速底座。

现网商用数据则显示,该方案在真实业务场景中表现卓越:

● 性能倍增:在实际话务模型下,支撑GLM-5.1、Kimi-K2.6、DeepSeek V4 、Qwen系列等主流大模型时,长序列(64K,128K等)场景下现网集群吞吐率单卡提升1.1~3倍,首Token时延(TTFT)降低30~40%,支撑并发会话数提升,显著优化了用户交互体验。

● 成本降低:通过UCM技术实现KV Cache的高效复用,Token推理成本降低30%,使得“Token低成本”成为可能,真正为运营商Token经营构筑核心竞争力。

该方案在内部Agent开发和AI coding场景中亦显著提升了工作效率,月均Token调用量已达500万次,并正在为秋季开学的高校校园Token算力大赛助力。天津移动人工智能产研院负责人表示:“此次AI推理加速方案正式商用,是双方协同创新推进的结果。未来我们将深化技术攻关,持续提升AI推理性能,夯实AI算力底座。”

天津移动规划技术部总经理杨桐指出:“从‘技术验证’到‘业务商用’,天津移动走在了行业前列。此次将AI推理加速方案直接应用于算力大赛,不仅是对技术稳定性的极致考验,更是我们对‘算力普惠’承诺的实践。通过AI存储带来的成本优势,我们让青年队伍能够毫无顾虑地释放创意,让算力像水电一样无处不在。未来,我们将基于此商用底座,进一步拓展ToB政企市场,将‘高性价比、低时延’的AI服务推向各行各业。”

华为全球数据存储Marketing与解决方案销售总裁邱峰表示:“天津移动的全国首商用,标志着华为AI推理加速方案从‘技术领先’正式走向‘商业成功’。OceanStor A800结合UCM技术,打破了内存容量限制,为运营商构建了极具竞争力的Token服务能力。我们期待与运营商携手,将这一经过现网验证的最佳实践复制到全国,共同开启Token经济的新篇章。”


通信世界网版权及免责声明:
1、凡本网注明“来源:通信世界全媒体”及标有原创的所有作品,版权均属于通信世界网。未经允许禁止转载、摘编及镜像,违者必究。对于经过授权可以转载我方内容的单位,也必须保持转载文章、图像、音视频的完整性,并完整标注作者信息和本站来源。
2、凡本网注明“来源:XXX(非通信世界网)”的作品,均转载自其它媒体,转载目的在于传递更多信息,并不代表本网赞同其观点和对其真实性负责。
3、如因作品内容、版权和其它问题需要同本网联系的,请在相关作品刊发之日起30日内进行。
发表评论请先登录
...
热点文章
    暂无内容