泡泡网显卡频道 PCPOP首页      /      显卡     /      评测    /    正文

最强性能!华硕HD7870 DCU II TOP测试

    最后,再来强调一下AMD抛弃5D/4D VLIW改用全新GCN架构的意义。

图形与计算那些事 AMD次世代架构解析

理想状态下毫不相干的四组线程执行情况

   在VLIW的理想情况下,4个线程分别各自独立且毫不相关,可以看到新架构和VLIW的执行情况和类似,理论上效率都是100%。

图形与计算那些事 AMD次世代架构解析

非理想状态下,条件相关线程延迟执行

    但对于VLIW架构来说,不理想的情况就是遇到相关的指令流,比如两个绿色线程,前三个线程可在一个周期内执行,最下方的蓝色只能独立执行。而对于新架构来说,则不存在这样的问题。也就是说,采用硬件调度之后,GCN和SIMD可以允许选择不同的线程乱序执行,这些线程可以来自同一任务,也可以是不同任务。当然,这种“乱序”也不是绝对的,基本的流程还是要遵守的,比如各个线程之间的指令必须按顺序执行,不能打乱也不能分割。

    以往的VLIW架构在并行任务处理方面处于劣势,并且很依赖编译器和API的支持,扩展到OpenCL也受到很大限制。经过硬件架构的调整,新的GCN架构在并行计算方面有了很大提高。编译压力减轻,硬件调度的加入使编译器摆脱了调度任务;其次是程序优化和支持语言扩充更见容易;最后是不用在生成VLIW指令和相关调度信息,新架构最底层的ISA也更加简单。

0人已赞

关注我们

泡泡网

手机扫码关注