首页 > 业界 > 关键词  > 特斯拉最新资讯  > 正文

特斯拉AI Day首秀:FSD进化?还有超算Dojo、500亿个晶体管D1芯片、人形机器人

2021-08-21 10:36 · 稿源: TechWeb.com.cn

【TechWeb】北京时间8月20日,特斯拉在美国成功举办AI Day活动。特斯拉CEO伊隆·马斯克、人工智能部门总监Andrej Karpathy等多位工程师,在线讲解特斯拉纯视觉方案FSD的进展、神经网络自动驾驶训练、D1芯片、Dojo超级计算机等相关信息。

特斯拉的纯视觉传感器方案的实现,离不开多任务学习HydraNets神经网络架构。每辆特斯拉汽车拥有8个环绕车身、覆盖周围360的摄像头,来获取交通信号灯、信号牌、匝道、路缘等周边信息,为神经网络学习提供了绝佳条件。

Andrej说:“我们希望能够打造一个类似动物视觉皮层的神经网络连接,模拟大脑信息输入和输出的过程。就像光线进入到视网膜当中,我们希望通过摄像头来模拟这个过程。”

多任务学习HydraNets神经网络架构可以将8个摄像头获取的画面拼接起来,并完美平衡视频画面的延迟和精准度。通过人工或自动标注车道、车辆、信号灯、障碍物等环境和动静物体,系统会逐帧分析视频画面,了解物体的纵深、速度等信息,再将这些数据交给车队学习。

但是在这个过程中,特斯拉发现了几个问题:这些参数和空间追踪是很难通过C++这个基础架构实现拼接的;有一些空间数据的输出质量不高;不同摄像头获取的物体信息不同,拼合时很难进行整体把握。

为解决这些问题,特斯拉开发了“矢量空间”(Vector Space)技术,同时兼具了非凸优化算法(Non-convex)、高维度两大优势。该技术可以通过8个摄像头输入的数据为基础绘制3D鸟瞰视图,形成4D的空间和时间标签的“路网”以呈现道路等信息,帮助车辆把握驾驶环境,更精准的寻找最优驾驶路径。

有了海量、精准的视频数据,特斯拉还需要创造一个强大的神经网络,并对网络进行特殊的布局,使这些数据能在一个总的主干网络上进行整合和重新分析。因此,特斯拉“高楼平地起”,自主研发了基于神经网络的训练方式。

特斯拉拥有一支由世界各地人才组成的数据标注团队,规模在1000人左右。团队每天对视频数据中的物体在“矢量空间”中进行标注,在善于把握细节的人工标注和效率更高的自动标注配合下,只需要标注一次,“矢量空间”就能自动标注所有摄像头的多帧画面。这为特斯拉带来了上百亿级的有效且多样化的原生数据,而这些数据都会用于神经网络培训。

同时,特斯拉还开发了“仿真场景技术”,可以模拟现实中不太常见的“边缘场景”用于自动驾驶培训。在仿真场景中,特斯拉工程师可以提供不同的环境以及其他参数(障碍物、碰撞、舒适度等),极大提升了训练效率。

由此,特斯拉FSD系统已可以实现每1.5毫秒2500次搜索的超高效率,预测可能出现的各种情况,并在其中找到最安全、最舒适、最快速的自动驾驶路径。

当下,随着所需处理的数据开始指数级增长,特斯拉也在提高训练神经网络的算力,因此,便有了特斯拉Dojo超级计算机。

特斯拉的目标是实现人工智能训练的超高算力,同时还要扩展带宽、减少延迟、节省成本。这就要求Dojo超级计算机的布局,要实现空间和时间的最佳平衡。

组成Dojo超级计算机的关键单元,是特斯拉自主研发的神经网络训练芯片D1芯片。D1芯片采用分布式结构和7纳米工艺,搭载500亿个晶体管、354个训练节点,仅内部的电路就长达17.7公里,实现了超强算力和超高带宽。

1500个D1芯片共53万余训练节点,组成了Dojo超级计算机的训练模块。由于每个D1芯片之间都是无缝连接在一起,相邻芯片之间的延迟极低,训练模块最大程度上实现了带宽的保留,配合特斯拉自创的高带宽、低延迟的连接器,算力高达9PFLOPs(9千万亿次)。

得益于训练模块的独立运行能力和无限链接能力,由其组成的Dojo超级计算机的性能拓展在理论上无上限,是个不折不扣的“性能野兽”。实际应用中,特斯拉将以120个训练模块组装成ExaPOD,它是世界上首屈一指的人工智能训练计算机。与业内其他产品相比,同成本下它的性能提升4倍,同能耗下性能提高1.3倍,占用空间节省5倍。

与强大硬件相匹配的,是特斯拉针对性开发的分布式系统DPU(Dojo Processing Unit)。DPU是一个可视化交互软件,可以随时根据要求调整规模,高效地处理和计算,进行数据建模、存储分配、优化布局、分区拓展等任务。

不久后,特斯拉即将开始Dojo超级计算机的首批组装,并从整个超级计算机到芯片、系统,进行更进一步的完善。

除了备受期待的神经网络学习与Dojo超级计算机,在活动末尾,马斯克在谈到AI发展方向时,还出乎所有人意料地抛出了“Tesla Bot”。Tesla Bot高1.72米,重56.6千克,脸上的屏幕可显示信息,拥有人类水平的双手,并有力反馈感应,以实现平衡和敏捷的动作。

马斯克表示,Tesla Bot将利用Dojo超级计算机的训练机制来改进功能,并补充道:“未来劳动力不会短缺,但体力劳动只是一种选择。Tesla Bot可以执行一些危险性、重复性、枯燥的任务。”Tesla Bot或将在明年推出首个原型机。

想象一下,如果特斯拉生产线的人类工人一半替换为机器人,Model3、Y会不会进一步降价,跌入20万以内区间?

举报

  • 相关推荐
  • iPhone 20冲击真全面屏悬了:苹果难以攻克屏下摄像头技术

    苹果计划2027年20周年iPhone弃用灵动岛,实现屏下Face ID与前摄的真全面屏。但博主认为屏下技术短期难商用,光线穿透、红外散射影响3D人脸识别及暗光进光未解,iPhone20或仍用缩小灵动岛。更可行方案是部分元件移屏下、保留前摄开孔缩小灵动岛,供应链已量产,iPhone18 Pro先商用,iPhone20或沿用。

  • 从马斯克到“烤斯克” 铜川烤肉师傅意外走红

    陕西铜川48岁烤肉师傅马建平因侧脸酷似马斯克意外走红,视频获赞破80万,被网友戏称“烤斯克”。他14岁外出打工,刚开店数月。走红后客流翻倍,甚至有人驱车百里打卡,但他依然早九晚至深夜踏实干活,不急于直播带货,表示“味道才是一辈子的”。凭踏实与淡然,他把小日子过得热气腾腾。

  • 苹果AirPods迎史上最大升级!首次加入摄像头 最快9月发布

    苹果首款配备摄像头的AirPods有望今年9月与iPhone 18 Pro系列一同发布。 知名苹果记者马克古尔曼透露,苹果目前正在同步推进两款配备摄像头的AirPods,项目代号分别为B790和B798。 其中,B798启动时间更早,产品定位也相对更高,原计划于2026年推出,但目前发布时间已推迟至2027年末。 与此同时,另一款代号为B790的产品也在开发中,其硬件进度更接近量产,部分相关代码已出现�

  • 659元!特斯拉上架Model Y单人充气床垫引热议 网友:给单身狗专门设计的

    近日,特斯拉中国在其Tesla App及小程序中上线了一款适用于Model Y的单人充气床垫,定价为659元。 值得注意的是,这款单人充气床垫尺寸并不适配Model Y L。 据官方介绍,该产品表面采用TPU弹力布,内里填充高密度PU泡棉。 其厚度达8厘米的高密度泡绵填充物打造柔软触感,聚酯材质让表面既经久耐用、细腻丝滑。

  • 马斯克:特斯拉FSD会模仿你的驾驶风格 越开越像自己开

    埃隆马斯克已确认特斯拉FSD(Full Self-Driving)软件正在从过去的通用型、一套方案适用于所有用户”的驾驶系统,转变为真正的个性化驾驶系统。 近日,一名特斯拉FSD用户在X平台上抱怨,车辆经常会在不该离开的位置驶出高载客车道或快速车道,主动退出左侧高效车道后进入拥堵车流,而旁边最左侧车道上的车辆仍然畅通无阻,非常令人烦恼。 对此,马斯克回应称:车辆将�

  • 陕西一饭店烤肉师傅撞脸马斯克走红 已有人上门求合作

    陕西铜川一位烤肉师傅因为长相高度酷似马斯克,被食客拍下短视频传到网上迅速走红,不少网友专程到店打卡,还有合作方主动上门洽谈。 这位师傅还姓马,今年40多岁,既是饭店合伙人,也是店里专职烤肉师傅,干烤串行业已经十多年。平时每天九点到店,忙到深夜十一二点才能收工。 线下早就有顾客说他五官神态像马斯克,偶尔会主动上前合影,只是一直没有大范围�

  • 苹果智能眼镜最早 WWDC27 登场:或取消摄像头,只为 AI

    据古尔曼最新消息,苹果内部代号为 N50的智能眼镜产品,最早会在2027年6月的 WWDC27上亮相,并在同年秋季正式发布。这比外界此前的猜测要更近一些。 隐私被摆在这款产品的核心位置。有说法称,苹果可能会取消摄像头,或者干脆禁止用眼镜拍照,让它的存在只为 AI 辅助服务,而非记录周边。 为了防滥用,苹果还参考了类似 Meta 眼镜的做法,加入防篡改的指示灯机制。一�

  • 特斯拉车机系统更新:首次接入豆包大模型

    特斯拉中国今日发布2026.14.13版本车载系统更新,即日起面向Model 3、Model Y、Model S、Model X 四款车型分批推送。 总体上看,本次升级囊括智能大模型接入、车载场景实用功能、交互体验优化以及多项系统安全漏洞修复,改动覆盖用车全场景。 值得一提的是,本次更新最大亮点,是特斯拉国内车载系统首次搭载第三方大模型字节跳动豆包大模型正式入驻车机,接替原有语音体系�

  • 马斯克的Grok上线Build模式:可通过自然语言生成网站、应用

    今日,马斯克旗下SpaceXAI发布公告,宣布为Grok应用引入Build模式。 在该模式下,用户只需要输入一段提示词,该模式就能把用户想法转换为带有独立域名的产品。 该功能目前以早期测试版形式向SuperGrok Heavy订阅用户开放,月费300美元,支可以通过网页端、安卓端和iOS端Grok应用使用Build模式,能够将文本提示实时转化为功能齐全的网站、工具、互动媒体,甚至是应用程序。

  • 全球参数最大开源模型 马斯克也点赞!月之暗面Kimi K3开源 2.8万亿参数

    日前,月之暗面正式发布Kimi K3模型权重及技术报告,并同步开源支撑该模型训练的三项关键基础设施技术:MoonEP、FlashKDA和AgentEnv。 据介绍,三项技术在Kimi K3的训练过程中发挥了重要作用,为大规模模型训练的效率、稳定性以及智能体任务执行提供基础支撑。 据了解,Kimi K3是月之暗面目前能力最强的模型,该模型采用混合专家(MoE)架构,总参数规模达到2.8万亿,具备原生

今日大家都在搜的词: