写点什么

特斯拉披露自家超算集群雏形,最新版本超算有望登顶世界第一?

  • 2021-06-23
  • 本文字数:1598 字

    阅读完需:约 5 分钟

特斯拉披露自家超算集群雏形,最新版本超算有望登顶世界第一?

特斯拉选择的是纯视觉的自动驾驶方案,这种方案对传感器的依赖较弱,但需要极强的数据处理和 AI 能力,这就使得自研适应性强的超级计算机显得很有必要。


随着自动驾驶的不断成熟,自动驾驶汽车公司对算力的需求正在呈指数级增长。在 2021 年计算机视觉和模式识别会议 (CVPR 2021) 上,特斯拉特斯拉人工智能与自动驾驶视觉总监(Director of AI and Autopilot Vision) Andrej Karpathy 公布了自家的第三个超级计算机集群,他声称这是还未发布的超级计算机 Dojo(Dojo 发音源自日语,意为 “道场”)的开发原型版本。


目前,这一开发原型版本的每秒浮点运算能力(FLOPS)已经达到世界第五的水平,而其正式版本,超级计算机 Dojo 将超越目前世界排名第一的日本超级计算机富岳(Fugaku,富士山的别名)。


特斯拉用超级计算机来做什么


其实早在 2019 年的特斯拉自动驾驶开放日 (Autonomy Day) 上,特斯拉 CEO 伊隆·马斯克就介绍过 Dojo 项目。彼时,马斯克提到,“那是一台超级强大的训练电脑,目标是能够接收大量数据并在视频级别进行培训,并使用 Dojo 程序或 Dojo 计算机对大量视频进行无监督的大规模训练 (unsupervised massive training)”。


Dojo 已经是特斯拉第三个自研的超级计算机项目了。那么,作为一家自动驾驶的车企,特斯拉为何要执着于打造超级计算机呢?


超级计算机(Super Computer),通常是体量巨大、造价高昂的设备,拥有数以万计的处理器,其能够执行一般个人电脑无法处理的高速运算,规格与性能比个人计算机强大许多。常用于需要大量运算的工作,譬如数值天气预报、运算化学、分子模型、天体物理模拟、汽车设计模拟、密码分析等。


对于自动驾驶车企而言,典型的自动驾驶解决方案有三种,分别是:1)基于视觉主导,采用 GPS 地图结合 AI 人工智能进行自动驾驶;2)基于激光雷达主导,视觉辅导,采用高精度地图和人工智能进行自动驾驶;3)基于车联网主导,多种传感器融合的人工智能自动驾驶。特斯拉选择的是第一种纯视觉的自动驾驶方案,这种方案对传感器的依赖较弱,但需要极强的数据处理和 AI 能力,这就使得自研适应性强的超级计算机显得很有必要。


在马斯克的介绍中,Dojo 将配合无监督学习算法(unsupervised learning)来减少特斯拉对于人工标注数据的工作量,进而帮助其实现指数级的数据训练效率提升。(注:无监督学习算法即无需人工对训练数据集进行标注,系统可以自行根据样本间的统计规律对样本集进行分析。如不给任何额外提示的情况下,仅依据一定数量“狗”的图片特征,将“狗”的图片区分出来)。


Dojo 的性能如何


在 2019 年特斯拉 AI Day 现场,马斯克说到“Dojo 使用我们自己的芯片和针对神经网络训练而优化的计算机架构,而不是 GPU 集群。如果我没弄错,这将是世界上最好的”。


如今,对于 Dojo 的雏形机,Karpathy 在 2021 年计算机视觉和模式识别会议 (CVPR 2021) 上表示,“我们展示的是使用 720 个 80GB 版本的 8x A100 节点构建的集群。这是一台巨大的超级计算机,就每秒浮点(FLOPS)运算次数而言,我认为它可能是全球第五的超级计算机。第五位目前由英伟达公司的 Selene 集群占据,该集群拥有非常相似的架构和类似的 GPU 数量(4480 对我们的 5760,所以少一点)”。


而对于 Dojo 最终发布的期望,特斯拉在 2020 年发布的推文中表示,Dojo 能够实现每秒千万亿次浮点运算(1000 PFLOPS),这将使得 Dojo 成为一款真正的尖端超级计算机。未来,Dojo 的算力将要达到每秒钟 exaFLOP(百亿亿次, 是千万亿次 PFLOPS 的 1000 倍) 的级别,并且运算速度要超过富岳(Fugaku),成为世界第一。


而富岳是目前世界上速度最快的超级计算机,其浮点计算的峰值速度可达到 442PFLOPS(每秒 442 x 1 千万亿次浮点运算),最高性能超过 1000 PFLOPS。




在 2020 年的世界超级计算机大会上(SC20),位列前五的超级计算机分别是,日本的富岳 Fugaku,美国的 Summit ,美国的 Sierra,中国的“神威·太湖之光” 和美国的 Selene。

2021-06-23 17:002228
用户头像

发布了 74 篇内容, 共 29.5 次阅读, 收获喜欢 83 次。

关注

评论

发布
暂无评论
发现更多内容

IC 首届全球黑客松奖金高达600 万美元,助力开发者勇闯 Web 3!

TinTinLand

区块链

场景驱动的特征计算方式OpenMLDB,高效实现“现算先用”

第四范式开发者社区

人工智能 机器学习 数据库 开源 实时计算

静态路由,YYDS

wljslmz

网络工程师 6月月更 静态路由 路由协议

java虚拟机启动过程解析

乌龟哥哥

6月月更

C#入门系列(二) -- 程序结构

陈言必行

C# 6月月更

DBNet实战:详解DBNet训练与测试(pytorch)

AI浩

人工智能 6月月更

Python的教程

芯动大师

Python编程 6月月更

火遍全网的AI给老照片上色,这里有一份详细教程!

博文视点Broadview

Django基础-1

zyf

django 6月月更

Neo4j 知识图谱的图数据科学-如何助力数据科学家提升数据洞察力线上研讨会于6月8号举行

GPU算力

发布一个轻量级的 Elasticsearch 压测工具 - Loadgen

极限实验室

elasticsearch 极限实验室 loadgen 压测工具 esrally

博睿数据荣获优炫软件产品兼容互认证书和海量数据兼容互认证书

博睿数据

智能运维 博睿数据 产品兼容 数据兼容

阿里云架构师梁旭:MES on 云盒,助力客户快速构建数字工厂

阿里云弹性计算

最佳实践 数字化转型 制造业 mes 云盒

Flutter如何一键唤起

坚果

6月月更

NFT,元宇宙的通行证

CECBC

写Python爬虫,服务器返回数据加密了,套路解决法~,出版社,出版社

梦想橡皮擦

6月月更

2022年SaaS的10个有趣趋势

小炮

私有化IM即时通讯怎样在保障企业安全下提高效率?

BeeWorks

web前端培训如何在 H5 网页中实现扫码功能

@零度

前端开发

聚焦Arbitrum开发热点技术,一探以太坊的L2未来

TinTinLand

用乐高玩转Scrum,轻松拿CSM证书

ShineScrum

Scrum ScrumMaster CSM 乐高

CC2530 GPIO口输出配置说明​

DS小龙哥

6月月更

实时特征计算平台架构方法论和基于 OpenMLDB 的实践

第四范式开发者社区

机器学习 数据库 AI 特征平台 特征工程

包装类这颗语法糖,其实并不甜

L

Java

纯CSS:动态渐变背景【一分钟学会】

德育处主任

CSS css3 纯CSS css特效 6月月更

区块链技术促进医药冷链物流更加可控和智能化

CECBC

推进流程挖掘技术发展,信通院首轮流程挖掘评测预报名正式启动

王吉伟频道

RPA 信通院 流程挖掘 流程挖掘评测 行业标准

LLVM之父Chris Lattner:模块化设计决定AI前途,不服来辩

OneFlow

机器学习 深度学习 AI

聊聊 Sharding-Jdbc 的简单使用

Nick

MySQL 分库分表 中间件 ShardingJDBC 6月月更

RxJS系列02:可观察者 Observables

代码与野兽

6月月更

最强分布式事务框架是怎么炼成的?

峨嵋闲散人

分布式事务 云原生 分库分表 无侵入 dbmesh

特斯拉披露自家超算集群雏形,最新版本超算有望登顶世界第一?_AI&大模型_施尧_InfoQ精选文章