SK 海力士与 Marvell 发布可将 GPU 吞吐量提升 5.5 倍的 CXL 内存模块

SK Hynix 和 Marvell 发布了 CMM-Ax,这是一款基于 CXL 的近内存计算模块,将 SK Hynix 高性能 DRAM 与 Marvell 的 Structera A 近内存处理引擎相结合。该模块将 16 个 Arm 数据中心 CPU 核心集成到 CXL 控制器中,并在直接于内存中处理数据时提供最高 200GB/s 的内部带宽。该设计面向大语言模型推理工作负载,尤其是 KV 缓存操作,通过在内存域中处理部分缓存来减少 GPU 往返延迟。在每个设备配置为 512GB 的评估中,该模块的吞吐量达到单 GPU 的 5.5 倍,以及双 GPU 的 3.6 倍。Yole Group 预测,CXL 市场将从今年约 21 亿美元增长至 2028 年约 160 亿美元,而 SK Hynix 将 CMM-Ax 定位为超越单纯容量竞争的“推理阶段智能内存”。

SK Hynix 和 Marvell 在 CMM-Ax 架构中集成 Arm 核心和 DRAM

CMM-Ax 模块架构不同于传统内存配置。SK Hynix 高性能 DRAM 与 Marvell 的 Structera A 近内存处理引擎相结合。CXL 控制器搭载 16 个高性能 Arm 数据中心 CPU 核心。当直接在内存中处理数据时,系统可提供最高 200GB/s 的内部带宽。

CMM-Ax 在大语言模型推理测试中的吞吐量达到单 GPU 的 5.5 倍

该模块的主要目标应用是大语言模型推理中的 KV 缓存处理。该方案在内存域内处理部分缓存,从而减少 GPU 往返延迟。在每个设备配置为 512GB 的评估中,其吞吐量达到单 GPU 的 5.5 倍,以及双 GPU 的 3.6 倍。

Yole Group 预计 CXL 市场到 2028 年将增长至 160 亿美元

SK Hynix 将该模块定义为“推理阶段智能内存”,将其定位为超越单纯容量竞争的解决方案。Yole Group 估计,CXL 市场将从今年约 21 亿美元扩大至 2028 年约 160 亿美元。后续验证要点包括 FMS 2026 的演示内容,以及实际服务器客户的采用时间。

常见问题

CMM-Ax 模块结合了哪些技术组件?

CMM-Ax 模块将 SK Hynix 高性能 DRAM 与 Marvell 的 Structera A 近内存处理引擎相结合,并将 16 个 Arm 数据中心 CPU 核心集成到 CXL 控制器中,在直接于内存中处理数据时提供最高 200GB/s 的内部带宽。

在大语言模型推理工作负载中,CMM-Ax 的性能与 GPU 配置相比如何?

在每个设备配置为 512GB 的评估中,CMM-Ax 在大语言模型推理 KV 缓存处理任务中的吞吐量达到单 GPU 的 5.5 倍,以及双 GPU 的 3.6 倍。

免责声明:以上内容(如有图片或视频亦包括在内)均为平台用户上传并发布,本平台仅提供信息存储服务,对本页面内容所引致的错误、不确或遗漏,概不负任何法律责任,相关信息仅供参考。

本站尊重他人的知识产权、名誉权等法律法规所规定的合法权益!如网页中刊载的文章或图片涉及侵权,请提供相关的权利证明和身份证明发送邮件到qklwk88@163.com,本站相关工作人员将会进行核查处理回复

(0)
上一篇 2026年8月11日 下午4:47
下一篇 2026年8月11日 下午4:49

相关推荐

风险提示:理性看待区块链,提高风险意识!