记者9月4日获悉,趋境科技与摩尔线程签署战略合作协议。此次合作以趋境科技自研的国产 PD 异构技术与摩尔线程MTT S5000智算卡与MUSA软件平台的深度融合为基础,双方将持续推进基于趋境科技ATaaS平台的国产化高品质AI Token工厂建设,并共同研发和推广以Token Pod(Token超节点)为载体的联合解决方案。
目前,相关方案已投入生产,并承接头部模型厂商官方业务的真实Token(词元) 流量。这一进展也标志着趋境科技携手摩尔线程,率先推动国产PD异构推理进入生产环境。
趋境科技与摩尔线程联合方案,并不简单只有来自硬件的价格差异,而是源于对Prefill(预填充)与Decode(解码)两个阶段的资源优化。由摩尔线程MTT S5000负责Prefill阶段的输入计算与KV Cache生成,与承担Decode阶段Token生成的高带宽 GPU 协同工作。
MTT S5000凭借高密度AI 算力、原生FP8精度,以及MUSA完善的软件栈与生态适配能力,支持Prefill从传统推理链路中解耦,构建可独立供给、独立计费、独立优化的算力资源池。趋境科技依托自研国产 PD 异构技术完成模型深度优化和跨设备协同,最终将不同类型的算力资源整合为统一、稳定的、高性价比的端到端推理服务。
这种配置减少了Prefill 阶段对高成本资源的占用,也避免按照单一阶段的峰值需求配置整套基础设施。在当前项目同等生产服务标准下,由4 至5台MTT S5000 组成的Prefill资源池,输入Token处理性价比超过国际先进算力方案。
这意味着,国产算力的竞争力正在从单卡性能延伸至系统级Token生产效率。通过国产硬件与 PD 异构技术的深度协同,趋境科技与摩尔线程为万亿参数大模型的规模化推理提供了一条兼顾生产级性能与成本效率的国产算力路径,从而让国产GPU的硬件能力转化为高品质AI Token产出。
9月17日,华为全联接大会在上海启幕。会上,华为发布了新一代AI算力基础设施昇腾960超节点。这款算力设施最多搭载的算力卡数量从上一代的1024卡升级到4096卡,并且首次采用一项名为“NPO(近封装光学)”的关键技...【详细】
9月17日至21日,第23届中国—东盟博览会在南宁国际会展中心举办。D区二层中央通道D2-08展位展示着一组被拆解的机器人核心部件。只见线束、连接器、视触觉传感器整齐陈列,屏幕实时跳动着指令数据。甚至在完全断网的情况...【详细】
大片草坪绿草茵茵,冷却湖水波光粼粼,主体建筑高大方正……“原来数据中心也能建得这么美!”日前,在安徽芜湖举办的2026 AIDC产业发展大会暨3D数据中心现场会期间,记者在参观华为云芜湖3D数据中心时,多次听到这样的...【详细】