数据世界
产业资讯 宏观经济 企业动态 人物动态 科技数码 数据洞察 AI前沿 行业峰会 热点资讯

华为云Tokens服务升级,384超节点助力实现2400TPS高性能算力

2025-08-28来源:ITBEAR编辑:瑞雪

在第四届828 B2B企业节的盛大开幕式上,华为云公布了一项重大进展:其Tokens服务已成功融入CloudMatrix384超节点体系。这一融合得益于xDeepServe架构的革新,使得单芯片的处理能力突飞猛进,达到了前所未有的2400TPS(每秒事务处理数),同时保持了50ms的TPOT(任务处理总时间),这一成绩远超当前行业标准。

面对中国AI算力需求的爆炸式增长,华为云展现出其“全栈创新”的实力。数据显示,从2024年初至2025年6月底,中国日均Token消耗量从1000亿飙升至30万亿,这一300多倍的增长凸显了人工智能应用的迅猛扩张,也对算力基础设施提出了更高要求。

早在今年3月,华为云便推出了基于MaaS(模型即服务)的Tokens服务,旨在满足不同应用与场景的性能和时延需求。该服务提供多种规格,如在线版、进线版、离线版及尊享版,为大模型和Agent智能体等AI工具提供了灵活、高效且成本优化的算力解决方案。

此次,Tokens服务与CloudMatrix384超节点的结合,通过xDeepServe框架的再次升级,将吞吐量从年初的1920TPS提升至2400TPS,TPOT则缩短至50ms。这一成就背后,是华为云从硬件到软件、从算子到存储、从推理框架到超节点的全方位技术创新。

CloudMatrix384超节点以其独特的计算架构,打破了性能瓶颈,奠定了坚实的算力基础。同时,CANN(昇腾计算架构)硬件使能技术优化了算子与通信策略,使得云端算力得以高效调用。EMS弹性内存存储则打破了AI内存墙,实现了“以存强算”,进一步释放了芯片算力。而xDeepServe分布式推理框架,则通过Transformerless的极致分离架构,让超节点能够释放出更高效的算力。

xDeepServe将MoE大模型拆解为可独立伸缩的Attention、FFN、Expert三个微模块,这些“积木”被分配到不同的NPU上同步处理任务,然后通过高效的XCCL通信库与FlowServe自研推理引擎重新组合,形成超高吞吐量的LLM服务平台。这一创新架构,使得单卡吞吐量从600tokens/s跃升至2400tokens/s。

XCCL作为专为超节点上的大语言模型服务设计的高性能通信库,充分发挥了CloudMatrix384的UB互联架构潜力,为Transformerless的全面分离提供了坚实的带宽与时延支持。而FlowServe作为“去中心”式分布式引擎,将CloudMatrix384划分为完全自治的DP小组,每个小组自给自足,确保了千卡并发时的流畅运行。

华为云MaaS服务目前已支持DeepSeek、Kimi、Qwen、Pangu、SDXL、Wan等主流大模型及versatile、Dify等主流Agent平台。通过大量的模型性能优化与效果调优,华为云实现了“源于开源,高于开源”,让大模型在昇腾云上展现出更卓越的性能。例如,在文生图大模型上,通过量化与融合算子等技术,华为云MaaS平台在轻微损失画质的情况下,实现了出图速度的两倍提升,最大支持2K×2K尺寸。在文生视频大模型上,则通过量化与通算并行等方式,大幅提升了视频生成速度,相较于竞争对手实现了3.5倍的性能优势。

在应用层面,华为云已与超过100家合作伙伴携手,深入行业场景,共同开发丰富的Agent应用。这些应用覆盖了调研分析、内容创作、智慧办公、智能运维等多个领域,解决了众多产业难题,帮助企业更便捷地拥抱AI创新,加速智能化转型。例如,基于MaaS平台推出的今日人才数智员工解决方案,集成了先进的自然语言处理、机器学习和深度学习技术,能够智能交互并处理任务,显著提升服务效率与客户满意度。而北京方寸无忧科技开发的无忧智慧公文解决方案,则提升了公文处理效能,推动了政企办公的智能化转型。

iPhone 17系列中国市场激活量破千万 性能升级受消费者青睐
【环球网科技综合报道】11月14日消息,据科技博主@数码闲聊站披露,苹果 iPhone 17 系列本周在中国市场的激活量已突破1000万台,创下该系列上市以来的阶段性销量新高,印证了中国消费者对其产品升级的认…

2025-11-15

荣耀500 Pro配置揭秘:骁龙8至尊版加持 8000mAh大电池续航无忧
8000mAh的大电池相较于上一代的7200mAh也是大升级,这个容量在同档位的机型中也是相当领先的。在这波大电池普及浪潮当中,荣耀后续还有望在其他机型上使用10000mAh电池,对续航要求高的用户需要密切关…

2025-11-14

iPhone 17系列发售不到俩月,中国市场激活量破1000W,双十一销量也亮眼
11月14日,数码博主“数码闲聊站”发文透露iPhone17系列于本周完成中国市场激活1000W+。 iPhone17系列9月19日正式发售,如今距发售不到两个月。 该博主此前曾透露,截至11月2日,iPh…

2025-11-14

vivo S50系列12月将至:S50 Pro mini紧凑旗舰,S50配望远镜后摄
vivo S50系列,包括 vivo S50和S50 Pro mini 。预计将在12月发布。 vivo S50 Pro mini将是一款紧凑型旗舰手机,配备 6.31 英寸显示屏。 据传闻 它将配备高通骁…

2025-11-13

​华为nova 15系列或用2.5D护眼直屏,标准版中框材质有变,12月难见其踪​
【CNMO科技消息】11月13日,有数码博主爆料称,华为nova 15系列大概率将采用全切2.5D定制护眼直屏,且中框材质并非全系为金属。 据CNMO了解,相比传统2D屏幕,2.5D屏幕在工艺复杂度上更胜一筹…

2025-11-13

荣耀500系列亮相,“双超”升级点燃市场期待
荣耀终端近日动作频频,在宣布荣耀400系列全球发货量突破600万台后,又迅速官宣了荣耀500系列的发布计划。这款备受期待的新机系列于11月13日正式亮相,凭借多项创新设计引发市场热议,其外观设计与核心配置的全面升级,展现出荣耀数字系列向高端化进阶的坚定决心。

2025-11-13

高通“一体双生”双旗舰战略持续推进 本月骁龙8 Gen5将亮相搭档8 Elite Gen5
【CNMO科技消息】11月12日,有数码博主爆料称,高通将长期保持“一体双生”双旗舰战略,即在同一代推出两款定位不同的旗舰级SoC。该博主表示,骁龙8 Gen5移动平台的安兔兔跑分高于骁龙8至尊版。 据CN…

2025-11-13

iQOO Neo11深度评测:骁龙8至尊版搭配Q2芯片,2K屏+7500mAh续航再掀性能风暴
去年的iQOO Neo10 依靠骁龙8 Gen3与1.5K屏,可谓是在2K价位段打出了一记漂亮的性能铁拳。在《王者荣耀》中,Neo11能稳定144Hz超满帧运行,帧率曲线几乎是一条直线。无论是《王者荣耀》1…

2025-11-13

谷歌入局私有AI计算:融合云端与端侧AI,隐私保护或成行业新标杆
该平台的核心目标是服务 Pixel 10 及后续手机,在严格保障用户隐私的前提下,为 Magic Cue 等功能注入更强大的云端 AI能力,该媒体认为这标志着谷歌在端侧 AI 与云端 AI 的融合上迈出了…

2025-11-12

iPhone18系列配置大揭秘:2亿像素主摄、自研5G基带C2,还有哪些惊喜?
目前,iPhone18系列手机已经全面曝光了,不得不说,苹果的营销真的做到了“不动声色”,新旗舰刚发布,下一代旗舰又开始收割用户了,据说主要有以下提升: 1.芯片方面,采用台积电2nm制程工艺的全新A20芯片…

2025-11-12