IBM与Together AI共建大型AI推理集群

发布时间:2026-08-17 10:15  点击:1次
IBM与Together AI共建大型AI推理集群

国际商业机器公司(IBM)宣布与AI初创企业Together AI签署一项多年合作协议,计划在IBM云平台构建一个大规模AI推理计算集群。该集群将整合Nvidia专为推理优化的硬件、Together AI开源AI解决方案以及IBM云的基础设施资源,目标是打造面向企业客户的高性能、安全可控的AI算力服务。项目预计于2027年第一季度投入运营,标志着IBM正加速从传统IT服务商向AI原生云平台转型。

此次合作的核心在于将Nvidia的GPU硬件与IBM云的弹性架构深度集成,支持高并发、低延迟的AI模型推理任务。据披露,集群将采用Nvidia H100或下一代Hopper架构GPU,具备每秒数万亿次浮点运算能力(TFLOPS),可支撑百亿参数级别大模型的实时推理需求。系统将基于Together AI提供的开源框架如Llama系列模型进行部署,确保模型可解释性与合规性,满足金融、医疗、制造等对数据安全要求较高的行业标准。

对于中国B2B从业者而言,该项目释放出明确信号:企业级AI基础设施正从“自建私有云”转向“云厂商+专业AI平台”协同模式。尤其值得关注的是,该集群并非仅用于内部测试或演示,而是以多客户共享、按需付费的云服务形式对外提供。这意味着未来中国企业若需部署大模型推理服务,将不再局限于采购昂贵的本地服务器,而是可通过订阅方式接入具备工业级稳定性的云端推理资源,降低初期投入与运维门槛。

从产业链角度看,该项目涉及多个关键环节:上游是Nvidia GPU的供应与授权,中游是IBM云平台的调度管理与网络优化能力,下游则是Together AI的模型封装与应用接口。对中国供应链企业而言,目前未提及具体采购量或国产替代路径,但可以预见,随着此类云推理集群规模扩大,对高性能散热系统、高速互联(如NVLink)、电源模块及定制化机柜的需求将同步上升。由于项目强调“企业级安全”,系统将内置端到端加密、访问控制策略和审计日志功能,这要求配套的网络安全设备、身份认证系统及合规管理工具也需同步升级。

项目名称为“推理集群”,但其底层架构已具备训练辅助能力。部分技术文档显示,该集群支持通过增量微调(fine-tuning)方式对基础模型进行轻量化调整,适用于垂直场景下的模型定制。这一特性使该平台不仅适合通用推理,也可服务于制造业质检、银行反欺诈、智慧医疗影像分析等细分场景。中国企业在评估是否接入此类服务时,应重点关注其支持的模型格式(如ONNX、TensorRT)、API调用延迟(建议低于50ms)、SLA(服务等级协议)中的可用性承诺(如99.95%以上)以及跨区域部署能力。

后续最值得持续关注的节点是2026年下半年,届时IBM有望公布首批签约客户名单、预留算力容量及实际负载测试结果。若出现来自欧洲金融机构或北美制造企业的订单,将进一步验证该集群的商业化可行性。对中国外贸企业而言,若已有客户在使用IBM云服务,可主动了解其AI推理服务的接入流程与成本结构;若从事AI芯片、服务器整机、边缘计算设备或软件中间件开发,亦可将其作为潜在合作伙伴或技术参考案例。

东莞集思网络公司

联系人:
曹洋(先生)
手机:
13760111111
地址:
上海曹杨路
我们发布的其他软件新闻更多
together新闻
13760111111 请卖家联系我