通信世界网消息(CWW)NVIDIA近日宣布,全球领先的系统制造商将推出AI就绪型服务器,其支持同于今日发布的VMware Private AI Foundation with NVIDIA,帮助企业使用自有业务数据来定制和部署生成式AI应用。
NVIDIA AI就绪型服务器将采用NVIDIA®L40S GPU、NVIDIA BlueField®-3 DPU和NVIDIA AI Enterprise软件使企业能够微调生成式AI基础模型并部署生成式AI应用,比如智能聊天机器人、搜索和摘要工具等。这些服务器还提供由NVIDIA加速的基础设施和软件,以支持VMware Private AI Foundation with NVIDIA。
作为全球领先的系统制造商的戴尔科技、慧与和联想,将于年底前推出搭载NVIDIA L40S的服务器,以加速推进企业级AI的发展。
NVIDIA创始人兼首席执行官黄仁勋表示:“全新的计算时代已经来临,各行各业的企业都在竞相采用生成式AI。我们正在通过涵盖全球顶尖软件和系统合作伙伴的生态系统,将生成式AI带给全球企业。”
对于将部署VMware Private AI Foundation with NVIDIA的企业来说,NVIDIA AI就绪型服务器是一个理想的平台。
VMware首席执行官Raghu Raghuram表示:"生成式AI正在大力推动数字化转型进程,企业需要一种全面集成的解决方案,以更加安全地构建应用,从而推动业务发展。通过VMware、NVIDIA、以及我们服务器制造商合作伙伴的专业知识相结合,企业将能够在确保数据隐私、安全和可控性的前提下开发和部署AI。
助推企业生成式AI转型
各行各业正在竞相将生成式AI用于药物研发、零售产品描述、智能虚拟助手、制造模拟、欺诈检测等各种用途,NVIDIA AI就绪型服务器将为这些行业提供全栈加速基础设施和软件。
这些服务器采用NVIDIA AI Enterprise,即NVIDIA AI平台的操作系统。该软件为100多个框架、预训练模型、工具套件和软件提供生产就绪型企业级支持和安全性,包括用于LLM的NVIDIA NeMo™、用于模拟的NVIDIA Modulus、用于数据科学的NVIDIA RAPIDS™和用于生产型AI的NVIDIA Triton™推理服务器。
专为处理包含数十亿参数的复杂AI工作负载而打造的L40S GPU搭载第四代Tensor Core和FP8 Transformer引擎,可提供超1.45 PFLOPS的张量处理能力,其训练性能是NVIDIA A100 Tensor Core GPU的1.7倍。
美国法官驳回对谷歌反垄断诉讼
小米旗下平板
相较于NVIDIA A100 GPU,NVIDIA L40S可将智能聊天机器人、助手、搜索和摘要等生成式AI应用中的生成式AI推理性能提高1.2倍。
通过集成NVIDIA BlueField DPU,可加速、卸载和隔离巨大计算工作负载,其中包含虚拟化、网络、存储、安全,以及其他云原生AI服务,以进一步提高速度。
NVIDIA ConnectX®-7智能网卡提供先进的硬件卸载和超低延迟,可为数据密集型生成式AI工作负载提供同类领先的可扩展性能。
推动企业生成式AI部署的庞大生态系统
全球领先的计算机制造商正在构建NVIDIA AI就绪型服务器,包括戴尔PowerEdge R760xa、适用于VMware Private AI Foundation with NVIDIA的慧与ProLiant Gen11服务器以及联想ThinkSystem SR675 V3。
戴尔科技主席兼首席执行官Michael Dell表示:“生成式AI是创新的‘催化剂’,将助力解决一些全球性的重大挑战。而采用NVIDIA AI就绪型服务器的戴尔生成式AI解决方案将扮演至关重要的角色,即通过推动生产力水平实现前所未有的提升,并变革工业运营的方式,以加速人类的进程。”
慧与总裁兼首席执行官Antonio Neri表示:“生成式AI将推动企业生产力规模的全新扩展——从赋能聊天机器人和数字助理,到帮助设计和开发新的解决方案。我们很高兴能继续与NVIDIA密切合作,在一系列企业级调优和推理工作负载解决方案中采用NVIDIA的GPU和软件,这将加速生成式AI的部署。”
联想集团主席兼首席执行官杨元庆表示:“企业迫切希望采用生成式AI来推动智能化转型。通过与NVIDIA和VMware合作,联想正在进一步扩大自身在生成式AI领域的领先地位,并巩固自身的独特定位,即在客户采用AI的旅程中为其提供帮助。”
供应情况
搭载L40S GPU和BlueField DPU的NVIDIA AI就绪型服务器将于年底前上市,云服务提供商预计将在未来几个月提供实例。