HarmonyOS开发者限时福利来啦!最高10w+现金激励等你拿~ 了解详情
写点什么

英伟达推出首个 CPU,基于 ARM 架构主攻巨型 AI,性能超 x86 十倍

  • 2021-04-13
  • 本文字数:1590 字

    阅读完需:约 5 分钟

英伟达推出首个 CPU,基于 ARM 架构主攻巨型 AI,性能超 x86 十倍

当今最大的 AI 模型包括数十亿个参数,并且每两个半月就会翻一番。训练它们需要一个新的 CPU,可以与 GPU 紧密结合,以消除系统瓶颈。


北京时间 4 月 13 日凌晨,英伟达在 GCT 2021 大会上宣布了 Grace、BlueField-3 DPU,还有用于自动驾驶的汽车 SoC 芯片三款处理器,均基于 Arm 架构打造。


其中最引人瞩目的当属名为 Grace 的 CPU 产品,这款产品主要为现代数据中心设计。这是英伟达首款服务器 CPU。英伟达认为,AI 模型的数据量和规模正在成倍增长。当今最大的 AI 模型包括数十亿个参数,并且每两个半月就会翻一番。训练它们需要一个新的 CPU,可以与 GPU 紧密结合,以消除系统瓶颈。

Grace 名字来自于计算机科学家 Grace Hopper,她曾是哈佛首批 Mark 1 程序员,并且发明了第一个链接器。据了解,Grace 芯片基于 Arm 打造,内置 Arm Neoverse 核心。


Grace 整个 SoC 由多个芯片组合构成,它主要有三个部分,分别是 CPU、GPU 和内存 /IO 子系统。英伟达表示,Grace CPU 将能够在 SPECrate2017_Int_base 中提供 300 分以上的成绩。对于这样的跑分,英伟达宣称 Grace 的性能基础是第四代 NVIDIA NVLink 互连技术,该技术在 Grace 和 NVIDIA GPU 之间连接速度超过 900GB/s,相当于目前服务器 14 倍的带宽;从 CPU 到 CPU 的速度超过 600GB/s。


据英伟达官方透露,Grace 还将采用 LPDDR5x 内存子系统,与 DDR4 内存相比,可提供两倍的带宽和 10 倍的能效,也就意味着,如果服务器使用这款 CPU,那么整套系统可以提供相较于 x86 CPU 的最新 NVIDIA DGX 快 10 倍的性能。此外,新的架构提供了统一的缓存一致性和单一的内存地址空间,将系统和 HBM GPU 内存结合在一起,简化了可编程性。


在 Grace 发布尾声,英伟达透露,Grace 将得到 NVIDIA HPC 软件开发包和全套 CUDA 和 CUDA-X 库的支持,这些库可以加速超过 2000 个 GPU 应用,加快科学家和研究人员对世界上最重要挑战的发现。

GraceCPU 预计将于 2023 年初上市,瑞士国家超级计算机中心(CSCS)和美国能源部的洛斯阿拉莫斯国家实验室(Los Alamos National Laboratory)将率先建造 NVIDIA CPU 驱动的超级计算机。


两大 AI 框架应对网络安全和语音对话需求

如今,网络安全已经成为每个企业乃至国家安全的重要防线。为了促进网络安全合作伙伴拥有检测和缓解网络安全攻击的 AI 技能,英伟达发布了一个“云原生”应用框架—Morpheus。Morpheus 运行时可以让网络中的计算节点充当传感器,对网络安全威胁进行监测,以作出自主响应。


Morpheus 内置机器学习模块,开发者可以使用深度学习模型创建自己的 Morpheus 技能,以此为基础,Morpheus 可以更加智能地识别、捕获威胁和异常情况,包括敏感数据的泄露、网络钓鱼企图和恶意软件,并对其采取行动。与传统网络安全框架相比,Morpheus 可以在同等投入下分析更多安全数据,且不会影响其性能。


除了 Morpheus,同样引人瞩目的 AI 框架还有 Jarvis。

在疫情大背景下,语音消息成为企业间相互联系,甚至是生活中线上沟通最常用的方式。为了应对日益增长的语音消息传递需求,英伟达宣布对话式 AI 框架 Jarvis 开始提供对手机和消息的普遍适用性。


简单来说,Jarvis 为开发人员提供预先训练的 AI 模型和软件工具,以创建交互式对话体验。据了解,Jarvis 模型的预览版在 2020 年 5 月首次推出,可为对话代理提供自动语音识别,语言理解、实时语言翻译和文本转换语音功能。


与此前相比,此次发布新版本的主要特性在于,该框架为更多开发人员开放了预先训练的开发模型和软件工具。据了解,Jarvis 的模型训练投入了超过 10 亿页的文本和超过 6 万小时的语音,如今,这些模型可以通过自定义数据进行调整、优化、微调,同时还能根据不同的任务、行业和系统进行定制,具有更优秀的普适性。


参考链接:

https://www.cnbeta.com/articles/tech/1113887.htm

https://www.cnbeta.com/articles/tech/1113901.htm

https://www.cnbeta.com/articles/tech/1113891.htm


2021-04-13 17:153336
用户头像

发布了 74 篇内容, 共 28.6 次阅读, 收获喜欢 83 次。

关注

评论

发布
暂无评论
发现更多内容

TOGAF 10新鲜出炉了!

涛哥 数字产品和业务架构

企业架构 TOGAF

【国产】ETL自动化调度运维管理平台 TASKCTL 8.0 分布式部署

敏捷调度TASKCTL

Docker DevOps 国产开源 大数据运维 TASKCTL

全网最细的短网址系统设计与实战

星牛君

MySQL redis 布隆过滤器 Java EE

高级Java面试经验总结:多家大厂简历优化+面试题目+面经+薪酬等

Java架构追梦

Java 程序员 面试 后端开发

看端点科技如何以行业实践探索企业数字化转型新路径

科技热闻

向着阳光的华为,淬火而行的哪吒

脑极体

yarn add electron安装失败

空城机

YARN Electron

服务器与普通台式机的对比及发展趋势

Finovy Cloud

gpu 云服务器 GPU服务器 GPU算力

观测云新增俄勒冈站点,布局全球可观测服务网络

观测云

时序数据库 VS 工业实时数据库

CnosDB

IoT 时序数据库 开源社区 CnosDB infra

算法交易的最佳编程语言是什么?

非凸科技

rust 编程语言 交易系统 策略

新品发布 | OpenHarmony面向教育行业的发行版+大赛预告来了~

拓维信息

活动 操作系统 OpenHarmony OpenAtom OpenHarmony OpenHarmony 3.1 Release

「可视化案例Vol.3」数字孪生可视化园区,开启园区智慧管理新篇章

ThingJS数字孪生引擎

物联网 可视化 数字孪生

多商户商城系统如何对接电商收付通?

CRMEB

Android C++系列:vector最佳实践

轻口味

c++ android 4月月更

SqlServer主备构建探索

Lane

SqlServer

Redis太难?阿里P8总结的Redis灵魂拷问70题解析,还不懂我就哭了

Java架构追梦

Java 后端开发 程序员面试 Redis 数据结构

博云首批通过欧拉技术测评,联合解决方案通过验证

BoCloud博云

新闻

“数聚赋能”,让实时数据中台成为惠企、惠民政策服务应用的源头活水

tapdata

数据中台 数字政务 实时数据 智慧政务

直播回顾:SIMD 指令集在 OpenJDK 中的现状与未来 | 龙蜥技术

OpenAnolis小助手

Java Openjdk simd arm 龙蜥社区

浅谈商业模式---《北大-真格创业课》笔记(30/100)

hackstoic

商业模式 创业公司

最佳实践 | 运维效率提升10倍的秘诀

星汉未来

DevOps 云原生 智能运维

IDC最新报告:澳鹏AI全生命周期数据解决方案在市场上具独特优势

澳鹏Appen

人工智能 大数据 数据标注 训练数据 数据训练

首版架构师全栈”成长笔记“一经发布就获得一致好评,我不允许你没看过

Java架构追梦

Java 程序员 java面试 后端开发

Tapdata Cloud 2.1.4 来啦:数据连接又上新,PolarDB MySQL、轻流开始接入,可自动标记不支持的字段类型

tapdata

SaaS 云数据库 Real Time DaaS polarDB DaaS

基于云效AppStack实现环境管理 | 开箱即用

阿里云云效

阿里云 研发管理 研发 应用交付 环境管理

Flutter 网络请求 Dio 拦截器详解

岛上码农

flutter ios 安卓开发 4月月更 跨平台应用

ImageKnife组件,让小白也能轻松搞定HarmonyOS图片开发

HarmonyOS开发者

HarmonyOS ArKUI 3.0

2022,「大厂云」还在找新着力点

ToB行业头条

一文看懂博睿数据AIOps场景、算法和能力

博睿数据

没日没夜做需求,就能交出满分答卷吗?

LigaAI

敏捷开发 需求

英伟达推出首个 CPU,基于 ARM 架构主攻巨型 AI,性能超 x86 十倍_硬件_施尧_InfoQ精选文章