华为发布并开源 Flex:ai AI 容器技术,实现单卡同时承载多个 AI 工作负载

2025-11-21 15:37 IT之家 - 汪淼
感谢IT之家网友 斯文当不了饭吃六月河 的线索投递!

IT之家 11 月 21 日消息,在今日的 AI 容器应用落地与发展论坛上,华为发布 Flex:ai AI 容器软件,通过算力切分技术,将单张 GPU / NPU 算力卡切分为多份虚拟算力单元,切分粒度精准至 10%,实现了单卡同时承载多个 AI 工作负载,并可聚合集群内各节点的空闲 XPU 算力聚合形成“共享算力池”。

Flex:ai 是一款基于 Kubernetes(开源容器编排平台)构建的 XPU(各种类型处理器)池化与调度软件,主要是通过对 GPU、NPU 等智能算力资源的精细化管理与智能调度,实现对 AI 工作负载与算力资源的“精准匹配”。

相比英伟达旗下 Run:ai 公司的核心技术,华为认为 Flex:ai 具备两大独特优势:

  • 一是虚拟化。除了在本地虚拟化技术中实现算力单元的按需切分,Flex:ai 独有的“拉远虚拟化”技术,可以不做复杂的分布式任务设置,将集群内各节点的空闲 XPU 算力聚合形成“共享算力池”。

  • 二是智能调度。Flex:ai 的智能资源和任务调度技术,可以自动感知集群负载与资源状态,结合 AI 工作负载的优先级、算力需求等多维参数,对本地及远端的虚拟化 GPU、NPU 资源进行全局最优调度,满足不同 AI 工作负载对资源的需求。

IT之家从发布会获悉,Flex:ai 将在发布后同步开源在魔擎社区中

广告声明:文内含有的对外跳转链接(包括不限于超链接、二维码、口令等形式),用于传递更多信息,节省甄选时间,结果仅供参考,IT之家所有文章均包含本声明。

文章价值:
人打分
有价值 还可以 无价值
置顶评论
    热门评论
      文章发布时间太久,仅显示热门评论
      全部评论
      一大波评论正在路上
        取消 发送
        分享成功

        长按关注IT之家公众号
        阅读更多精彩文章

        查看更多原创好文
        软媒旗下人气应用

        如点击保存海报无效,请长按图片进行保存分享