近期,行云科技股份有限公司(以下简称“行云科技”)凭借落地50000P FP4稠密算力引发市场热议,部分投资者因FP4、FP8、FP16精度差异,对其算力含金量产生质疑。
事实上,FP4、FP8、FP16是GPU适配不同AI任务的计算精度模式,位数越低、推理效率越高、单位词元成本越低。不同精度对应差异化商业场景,各司其职:FP4适配主流大模型推理,精度损失可控,是当前AIGC落地成本最优解;FP8适配模型微调、多模态对齐等轻训练任务;FP16则用于基座预训练、高端科学计算。
相较于传统算力租赁企业单纯堆砌GPU规模,行云科技打造超级词元工厂新模式,构建核心技术壁垒。该公司依托首席科学家团队自研AlayaJet推理引擎,通过软硬件协同优化,大幅提升单卡词元产出效率、压降推理成本,实现算力价值最大化。
凭借技术与硬件双重优势,行云科技入局算力赛道半年,已落地近150亿元大额算力订单,覆盖央企、头部科技企业,并获得百亿级银团授信,为后续扩张筑牢资金基础。
业内认为,行业新阶段竞争逻辑已改变,算力比拼不再是硬件数量竞赛,而是词元产出效率、成本控制、交付能力的综合比拼。行云科技以高端FP4算力为底座、自研引擎为核心,精准卡位AI推理高景气赛道,成长潜力突出。