传统数据中心从规划到运营通常需要数年时间,而 AI 基础设施公司 Runware 认为三周即可完成同等规模的部署。该公司周二发布了模块化推理计算单元 Sonic Inference Pod,一个可随处部署的集装箱式计算单元,只需通电即可快速投入运行。
每个 Sonic Inference Pod 采用 20 英尺集装箱封装,内置超过 1000 块 GPU,配备专有液冷系统,可提供 1 兆瓦的推理算力。将多个 Pod 堆叠组合,就可以构建一个数据中心——一个无需数年审批、施工和电网谈判的数据中心。Runware 声称部署时间约为三周,比传统建设快 50 倍。
Sonic Inference Pod 专为 AI 推理负载而设计,而非模型训练。推理是模型响应用户查询的关键环节,需要靠近用户、低延迟、大规模运行。Runware 将该产品定位为边缘部署方案,面向生成式媒体平台、实时多模态应用等对延迟敏感的场景。Pod 可利用区域性廉价电力,绕开 AI 基础设施建设中最大的难题之一——在人口密集区域附近寻找足够便宜的电力。
软件层面同样关键。Runware 构建了名为 Model Lake 的统一模型仓库,包含超过 40 万个 AI 模型,系统可在 Pod 间进行优化路由,将查询引导至正确位置的正确模型。
Runware 计划部署 10000 个 Sonic Inference Pod,按每单元 1 兆瓦计算,将形成相当规模的分布式算力版图,不过公司未透露实现该目标的时间表。
资金方面,Runware 于 2024 年 11 月完成 300 万美元融资,2025 年 9 月完成 1300 万美元种子轮,最近又在 2025 年 12 月至 2026 年 1 月间完成 5000 万美元 A 轮融资,累计披露融资额达 6600 万美元。该公司宣称,相比传统方案,其基础设施成本可降低十倍,逻辑在于规模化部署集装箱化硬件、使用区域电力而非集中电网接入,并通过软件层消除冗余的模型存储和算力浪费。
免责声明:本文提供的信息不是交易建议。BlockWeeks.com不对根据本文提供的信息所做的任何投资承担责任。我们强烈建议在做出任何投资决策之前进行独立研究或咨询合格的专业人士。