登录  | 立即注册

游客您好!登录后享受更多精彩

QQ登录

只需一步,快速开始

查看: 683|回复: 5

显存延迟测试:AMDRNDA2架构竟比英伟达AmpereGPU更优秀

[复制链接] TA的其它主题

65

主题

1188

回帖

4288

积分

论坛元老

积分
4288
发表于 2021-4-20 13:12:43 | 显示全部楼层 |阅读模式 来自 江苏苏州
经过多年发展,GPU 硬件也迎来了多级缓存结构。通过精心的设计,其能够有效缓和各个 PC 计算组件之间的性能掣肘。但不同 GPU 制造商之间的架构设计思路,仍有着较大的差别。以目前占独显市场最多的英伟达和 AMD 为例,两家公司旗下的竞品 GPU 就具有不同大小的寄存器和 L1 / L2 缓存。
比如英伟达 A100 GPU 的 L2 缓存容量为 40MB,直接增加到了上一代 V100 的七倍。显然,这考虑到了许多新应用程序需要更大的缓存,且为后续不断增长的使用需求而预留了一定的空间。
有趣的是,Chips and Cheese 于近日发布了一份有趣的报告,揭示了 AMD 最新一代的 RNDA 2、和英伟达 Ampere GPU 之间的显存延迟表现。

                               
登录/注册后可看大图


显存延迟比较(越低越好)
通过在 OpenCL 中使用简单的指针追逐测试,其得到了一份有趣的结果。其中采用 RDNA 2 架构的 AMD Radeon RX 6800 XT 显卡,其 Infinity Cache 高速缓存的表现很是亮眼。
与采用 Ampere 架构的英伟达 GeForce RTX 3090 旗舰显卡相比,即便显存(VRAM)方面的延迟几乎一致,但 IF 设计还是大幅降低了 Radeon RX 6000 显卡的访问延迟。
TechPowerUp 指出,英伟达 Ampere GPU 使用了 L1 + L2 两级缓存系统,测试表明这套解决方案的效用相当缓慢。在从 Ampere SM(L1 缓存)向 L2 传输的时候,数据延迟竟高达 100ns 。
另一方面,尽管 AMD RDNA 2 GPU 具有 L0 / L1 / L2 三级缓存系统(Infinity Cache 理论上也可以视作 L3 缓存),但 A 卡的显存延迟仍低得多。即便从 L1 到 L2,也只需 66 ns 。
感兴趣的朋友,可移步至 Chips and Cheese 查看《GPU 显存延迟测试》全文。
发表于 2021-4-20 13:28:09 | 显示全部楼层 来自 江苏苏州

                               
登录/注册后可看大图


                               
登录/注册后可看大图
回复

使用道具 举报

发表于 2021-4-20 13:43:11 | 显示全部楼层 来自 江苏苏州
30系真的是拉,这三星8nm还不如继续用台积电12nm,反向升级给������看吐了
回复

使用道具 举报

发表于 2021-4-20 13:57:45 | 显示全部楼层 来自 江苏苏州
这就是amd显卡没有工作能力不能干活的原因吗。
只会花钱买自媒体不去烧钱开发配套开发软件?
回复

使用道具 举报

发表于 2021-4-20 14:12:43 | 显示全部楼层 来自 江苏苏州
如果老黄用7nm肯定会比AMD强
回复

使用道具 举报

发表于 2021-4-20 14:12:43 | 显示全部楼层 来自 江苏苏州
老黄用比amd更垃圾的延迟,更垃圾的工艺,做出了比AMD更好的性能。这是打谁的脸?

                               
登录/注册后可看大图
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

QQ|极速版|触屏版|小黑屋|申请友链|极客论坛 - 计算机软硬件与网络

GMT+8, 2026-9-26 14:46 , Processed in 0.073713 second(s), 27 queries .

快速回复 返回顶部 返回列表