在人工智能产业全面迈入AI大转型的浪潮下,Token经济正在引发算力产业的系统性变革。对绝大多数企业来说,自己搭建全套AI算力设备成本高、投入大、回本慢,因此直接租用运营商的云端算力,就成了性价比最高的首选方式。而企业想要把租用的算力真正转化为实实在在的业务收益,核心就在于Token如何保持在企业和运营商远端算力之间高效、安全流通。
金融、政务、医疗等行业对话Prompt、病历文本、合同文档、交易指令等原始数据 属于核心隐私数据,监管要求原始数据必须本地留存、数据不出园区,不可直接全量上传公有智算中心。企业在租用云端算力时必须保证数据在传输、AI模型训练和使用的全过程不泄露、不被窃取,才会放心选用运营商的算力服务。传统公网、普通专线存在丢包、拥塞、长时延问题,微小的网络丢包导致海量数据在网络侧重传,整体计算等待通信导致Token吞吐率(Tokens Per Second,TPS)下降,推理首Token延迟显著、用户对话体验差;算力资源空置也导致模型训练周期被大幅拉长,甚至导致单轮训练失败,海量训练Token算力投入直接作废。针对企业算力使用的安全、效率、扩容三大核心难题,华为推出的AI WAN分布式训推解决方案,精准匹配企业实际需求,核心优势主要体现在三个方面:
第一,全程守护数据安全,杜绝核心信息泄露。该方案通过模型分割技术将模型不同层次分别部署在企业园区和运营商算力中心。在训练与推理全过程中,Token以无法还原的高维隐变量的形式在本地与智算中心之间传输,全方位守护用户隐私与核心数据资产安全。
第二,大幅提升算力效率,告别拉远训推损耗问题。大模型分布式训推高度依赖RDMA无损通信, 当Token以高维向量形式在网络流通时,对丢包容忍度极低。行业实测数据显示,即使网络只有0.1%的轻微数据丢失,就会引发大量数据重复传输,导致算力设备闲置空转,大幅降低TPS。华为星河路由器加持TOKEN无损传输技术,有效解决长距离传输瓶颈。实测数据显示,700公里分布式拉远场景,部署星河路由器后,基于边云协同推理的TPS劣化从55% 显著降低至5%以内,基本媲美企业本地搭建算力设备的运行效果。
第三,算力扩容灵活高效,适配企业业务波动。依托租赁运营商云端算力,企业可以根据自身业务需求,随时弹性增减算力资源。以往企业搭建、扩容算力设备,需要花费数月时间,现在只需要短短几小时就能完成,从而轻松应对业务高峰期、模型微调等带来的算力潮汐需求。
面向未来Token经济产业的迭代升级需求,华为AI WAN解决方案将持续深耕技术创新,不断优化广域无损传输、AI智能调度、全域安全防护三大核心能力。同时,华为将携手各大运营商落地本地化算网一体化服务,打通行业算力供需壁垒,全面加速Token在各产业场景的高效流通。
