泡泡网显卡频道 PCPOP首页      /      显卡     /      评测    /    正文

图形与计算那些事 AMD次世代架构解析

    最后,再来强调一下AMD抛弃5D/4D VLIW改用全新GCN架构的意义

图形与计算那些事 AMD次世代架构解析

理想状态下毫不相干的四组线程执行情况

    在VLIW的理想情况下,4个线程分别各自独立且毫不相关,可以看到新架构和VLIW的执行情况和类似,理论上效率都是100%。

图形与计算那些事 AMD次世代架构解析

非理想状态下,条件相关线程延迟执行

    但对于VLIW架构来说,不理想的情况就是遇到相关的指令流,比如两个绿色线程,前三个线程可在一个周期内执行,最下方的蓝色只能独立执行。而对于新架构来说,则不存在这样的问题。也就是说,采用硬件调度之后,GCN和SIMD可以允许选择不同的线程乱序执行,这些线程可以来自同一任务,也可以是不同任务。当然,这种“乱序”也不是绝对的,基本的流程还是要遵守的,比如各个线程之间的指令必须按顺序执行,不能打乱也不能分割。

图形与计算那些事 AMD次世代架构解析

    以上就是AMD官方提供的数据,HD7970的理论运算能力相比HD6970提升不过30%,但在GPU计算应用当中的性能提升相当显著,可达两倍以上!尤其在AES加密解密算法中,速度达到了4倍以上,架构的威力可见一斑!

图形与计算那些事 AMD次世代架构解析

HD7900会在WinZIP当中有更好的加密压缩解压性能

图形与计算那些事 AMD次世代架构解析

高清视频实时防抖处理

图形与计算那些事 AMD次世代架构解析

AMD在努力:支持GPU计算的软件越来越多

    以往的VLIW架构在并行任务处理方面处于劣势,并且很依赖编译器和API的支持,扩展到OpenCL也受到很大限制。经过硬件架构的调整,新的GCN架构在并行计算方面有了很大提高。编译压力减轻,硬件调度的加入使编译器摆脱了调度任务;其次是程序优化和支持语言扩充更见容易;最后是不用在生成VLIW指令和相关调度信息,新架构最底层的ISA也更加简单。

2人已赞

关注我们

泡泡网

手机扫码关注