-
昇腾SWA混合注意力训练实践,加速模型训练迭代,长序列推理性能跃升3.5倍
昇腾提出一种高效的SWA(Sliding Window Attention)模型局部稀疏化方案,以Qwen2.5-1.5B模型为例将模型部分Full Attention层替换为 Sliding Window Attention,实现长序列场景下推理吞吐3.5倍提升,提供高效落地的模型改造路径参考实践。
-
华为云行业大模型团队AI PPT登顶PresentBench榜单
近日,华为云行业大模型多模态智能团队参评的AI PPT(hwc-mmi-aippt)登顶权威评测榜单,在清华大学团队发布的细粒度幻灯片生成评测基准PresentBench公开排行榜中,以70.8分的成绩位列总榜第一,刷新榜单。
-
昇腾950超节点真机亮相2026世界人工智能大会
本次WAIC,华为首次线下展出昇腾950超节点(Atlas 950 SuperPoD),该产品基于灵衢互联协议和超节点架构,实现业界最大1024卡规模,提供1 EFLOPS FP8 、2 EFLOPS FP4澎湃算力,拥有256TB全局统一内存编址空间,依托TB级NPU互联超大带宽与3μs 超低RTT时延,突破集群内计算、存储等各类资源的通信瓶颈。
-
昇腾SWA混合注意力训练实践,加速模型训练迭代,长序列推理性能跃升3.5倍
昇腾提出一种高效的SWA(Sliding Window Attention)模型局部稀疏化方案,以Qwen2.5-1.5B模型为例将模型部分Full Attention层替换为 Sliding Window Attention,实现长序列场景下推理吞吐3.5倍提升,提供高效落地的模型改造路径参考实践。
-
华为云行业大模型团队AI PPT登顶PresentBench榜单
近日,华为云行业大模型多模态智能团队参评的AI PPT(hwc-mmi-aippt)登顶权威评测榜单,在清华大学团队发布的细粒度幻灯片生成评测基准PresentBench公开排行榜中,以70.8分的成绩位列总榜第一,刷新榜单。
-
昇腾950超节点真机亮相2026世界人工智能大会
本次WAIC,华为首次线下展出昇腾950超节点(Atlas 950 SuperPoD),该产品基于灵衢互联协议和超节点架构,实现业界最大1024卡规模,提供1 EFLOPS FP8 、2 EFLOPS FP4澎湃算力,拥有256TB全局统一内存编址空间,依托TB级NPU互联超大带宽与3μs 超低RTT时延,突破集群内计算、存储等各类资源的通信瓶颈。
开发入门
开发文档
开放能力
技术热点
学习成长
最新活动
体验昇腾CANN
体验鲲鹏BoostKit
开发者空间
AI训练营
云学堂