IBM deploys Nvidia HGX B300 cluster on IBM Cloud, targeting regulated AI workloads

IBM Cloud正式上线Nvidia HGX B300 GPU集群,单节点配备8颗Blackwell Ultra GPU,FP4精度算力达144 PFLOPS,结合Red Hat OpenShift与watsonx平台,面向金融、医疗、政府等受监管行业的AI工作负载。

IBM Cloud 正式上线基于 Nvidia HGX B300 的 GPU 集群,将 Blackwell Ultra GPU 引入托管云环境,供金融、医疗、政府等受监管行业使用。该系统约于 4 月 29 日投入使用,是两家公司自 3 月 GTC 2026 大会宣布扩大合作后的最新落地成果。

每个 HGX B300 系统在一个节点内集成 8 颗 Blackwell Ultra GPU,FP4 精度下算力最高可达 144 PFLOPS,FP8 精度下为 72 PFLOPS。每个系统配备超过 2 TB 的共享 HBM3e 内存,可避免大语言模型训练时因数据搬移导致的性能损耗;网络侧通过 Nvidia ConnectX-8 适配器实现每 GPU 800 Gb/s 互联,确保多节点训练不被网络层拖累。

此次部署整合了 Red Hat OpenShift 与 IBM watsonx 平台,形成面向受治理 AI 工作流的完整技术栈。OpenShift 负责容器编排,支持工作负载在本地与云端环境间迁移;watsonx 提供 AI 开发工具与治理层,使企业能在混合云环境中训练和部署模型,同时将敏感数据限定在合规边界内。

HGX B300 初期仅面向指定客户和区域开放,后续将逐步扩大范围。IBM 还透露,HGX B300 系统的 Serverless 算力访问预计于 2026 年 5 月推出,届时客户可在不管理底层基础设施的情况下按需消费 GPU 算力。

该集群与 IBM Cloud 现有的 H200 实例形成互补,后者面向无需 Blackwell Ultra 级算力的较低性能工作负载。

免责声明:本文提供的信息不是交易建议。BlockWeeks.com不对根据本文提供的信息所做的任何投资承担责任。我们强烈建议在做出任何投资决策之前进行独立研究或咨询合格的专业人士。

(0)
区块链小猫的头像区块链小猫作者
上一篇 3小时前
下一篇 2小时前

相关推荐

发表回复

登录后才能评论
分享本页
返回顶部