Rebellions,这家南韩AI半导体公司成功在国内神经处理单元(NPU)服务器上运行了SK Telecom的超大型AI模型A.X K1,该公司于23日宣布。Rebellions使用其自研AI服务器“Rebel Server”,稳定执行了拥有超过5000亿参数的模型,并展示了一个AI智能体服务,可同时处理多位用户的请求。该成果表明,仅依靠国产AI模型和NPU基础设施也能运行大规模AI服务,使其成为主权AI能力的可行实践范例。Rebellions是SK Telecom在科学技术信息通信部独立AI基础模型项目下的联盟成员,负责展示基于国产NPU的AI基础设施。
Rebellions针对MoE架构和并行处理优化软件
A.X K1应用了专家混合(Mixture of Experts,MoE)结构,该结构会有选择地仅使用必要的专门模型,以提升大规模模型的计算效率。Rebellions为MoE模型优化了专用软件,并将技术应用于将各类运算分发到NPU上以实现并行处理。这使得单台服务器能够在实时模式下处理多项用户请求。公司表示,单台Rebel Server所保障的基础设施性能可与全球高性能图形处理单元(GPU)服务器相当,从而降低数据中心建设和运营负担。
Rebel Server展示实时多用户AI智能体服务
在此次展示中,Rebellions展示了一项智能体服务:用户可以提出诸如“周末有药店吗”之类的问题,并获得以地图形式展示的结果。即使多个用户同时输入不同问题,系统也能实时处理并返回答复。此次展示验证了该服务器在稳定性能下承载并发的多用户工作负载的能力。
Rebellions参与政府AI基础模型项目
Rebellions首席执行官Park Sung-hyun表示:“这是主权AI的一个切实案例,表明可仅使用国产超大型模型和国产NPU来运行大规模AI服务。”Rebellions作为联盟成员参与SK Telecom在科学技术信息通信部独立AI基础模型项目下的工作,在该项目中负责展示基于国产NPU的AI基础设施。
常见问题
Rebellions与SK Telecom的A.X K1模型一起取得了什么成果?
Rebellions成功在其基于国内NPU的Rebel Server上运行了SK Telecom的A.X K1 AI模型,该模型拥有超过5,000亿参数。公司展示了一项AI智能体服务,可在实时状态下同时处理多项用户请求。
Rebel Server如何高效处理大型AI模型?
Rebel Server针对A.X K1所使用的专家混合(Mixture of Experts,MoE)架构优化了软件,将各类运算分发到NPU上以实现并行处理。这样,一台服务器在实时处理多项用户请求的同时,也能达到与全球高性能GPU服务器相当的基础设施性能。
免责声明:以上内容(如有图片或视频亦包括在内)均为平台用户上传并发布,本平台仅提供信息存储服务,对本页面内容所引致的错误、不确或遗漏,概不负任何法律责任,相关信息仅供参考。
本站尊重他人的知识产权、名誉权等法律法规所规定的合法权益!如网页中刊载的文章或图片涉及侵权,请提供相关的权利证明和身份证明发送邮件到qklwk88@163.com,本站相关工作人员将会进行核查处理回复