山东移动携手中兴通讯打造千卡智算推理资源池

发布时间:2026-04-20 作者:中兴通讯 陆威,蒋妍;山东移动 杨晓曦

        2025年,大模型技术开始成熟并逐步落地,赋能各行业智能化应用。但在行业智能化发展过程中,政企客户普遍面临智算成本高、技术门槛高、进口受限、数据安全保障难等困境,“好用且不贵”的智算基础设施成为企业智能化转型的迫切需求。作为山东本土数字赋能主力军,山东移动以打造“中国北方人工智能创新发展高地”为目标,推动AI技术落地实体经济。

        山东移动对省内300多家政企进行调研,深刻理解行业客户的痛点,协同多家智算厂商讨论解决方案,计划打造全栈自主可控、低成本、高可靠的智算推理资源池。综合考虑产品、方案、集成能力、工程交付及未来演进等因素,山东移动最终选择与中兴通讯携手合作。

        中兴通讯“全栈智算解决方案”精准契合山东移动的需求,实现技术自主可控、成本管控与多场景适配,凭借高效的工程落地能力,仅用45天就完成方案设计及工程部署,为智算应用落地提供了基础设施保障。

        此次项目的应用场景是为行业客户提供推理服务。推理场景对GPU卡的算力要求没有训练场景高,但对成本和时延要求比较高。基于这一核心诉求,中兴通讯和山东移动分析了数十款国产GPU卡,首先排除生态封闭的产品,再对比多家GPU卡的算力、显存、网络带宽、算子库兼容性以及成本,最终选择两款GPU卡,构建异构计算集群,分别满足小模型和大模型的应用场景。在选定GPU卡后,中兴通讯基于全栈集成和软硬优化的技术能力,在实验室提前完成端到端的兼容性测试,并针对模型特定优化了算子库,通过软件最大化发挥GPU、存储、网络等硬件潜力,联合山东移动打造出兼具低成本、高适配、高可靠的千卡推理资源池。总体方案架构如图1所示。

 

  • 全栈技术能力,筑牢数字安全屏障
     

        项目实现从芯片、硬件到软件平台的全栈技术自主可控。硬件层采用国产天数智芯高性能AI加速卡,资源管理层依托中兴通讯自研AI平台实现开放解耦,模型层完成DeepSeek R1全系列、Qwen3、Nebula等主流模型的适配。基于多卡多模型协同架构,资源池支持大模型+小模型混合推理,为行业客户提供自主可控、高性价比的AI算力解决方案。

  • 全生命周期降本,提供“好用不贵”的智算服务
     

        项目实现全生命周期降本,通过全流程优化,为行业客户提供高性价比智算服务。在产品方案选型阶段,基于行业客户特点和应用场景需求选择综合性价比最优的产品;在方案设计阶段,采用一体化资源整合和协同设计,减少多厂商对接成本;在项目交付阶段,持续迭代完善软硬件资源配比和流程,提升资源利用率;在商用运营阶段,采用自动化运维工具,大幅减少人工成本。

  • 多元算力,精准匹配行业客户多场景应用
     

        本项目部署两款推理型服务器,一款是天垓150服务器,显存较大,专用于大模型跨机推理,另一款是天垓100服务器,显存稍低功耗更小,用于中小模型推理。采用统一资源调度平台管理异构GPU,支持按政企客户使用的模型分级调度,小模型(如70B以下)部署于天垓100服务器,实现低功耗推理以降低TCO,大模型(如70B以上)则部署于天垓150服务器,用高算力、大显存GPU卡保障吞吐与低延迟。这种精准匹配既防止轻量任务占用高端算力造成的资源空转,也确保大模型推理不因硬件瓶颈而被迫降低并发业务量或截断上下文推理。

  • 高效协同集成部署,45天快速投产
     

        本项目规模达千卡,投入较大。时间就是金钱,项目越早部署完成,越早带来收益。中兴通讯通过科学拆解项目流程、预判落地隐患,实现“一站式部署”,无需分阶段对接多厂商,全程提供技术调试支撑,实现“部署即上线、上线即见效”的闭环体验,在45天内完成方案设计和工程交付,为政企合作树立了敏捷交付标杆。

 

        回顾项目合作历程,其成功离不开山东移动“以客户为中心”的项目定位,也离不开中兴通讯的技术支撑。中兴通讯通过整合全链条资源、优化项目落地流程、协同设计保障软硬件兼容性、精细化成本管控等一系列举措,实现了运营商、设备厂商与行业客户的三方共赢,充分彰显了其在智算领域的全栈系统能力。

        未来,山东移动将继续与中兴通讯深化合作,依托中兴通讯技术优势,结合自身网络与服务资源,整合更多行业场景与模型,深化“数算智”全要素布局,持续完善“运营商+设备厂商+行业客户”的协同生态,让高性价比智算服务覆盖更多政企客户,助力AI技术与实体经济的深度融合。