最强性能!华硕HD7870 DCU II TOP测试
分享
最后,再来强调一下AMD抛弃5D/4D VLIW改用全新GCN架构的意义。
理想状态下毫不相干的四组线程执行情况
在VLIW的理想情况下,4个线程分别各自独立且毫不相关,可以看到新架构和VLIW的执行情况和类似,理论上效率都是100%。
非理想状态下,条件相关线程延迟执行
但对于VLIW架构来说,不理想的情况就是遇到相关的指令流,比如两个绿色线程,前三个线程可在一个周期内执行,最下方的蓝色只能独立执行。而对于新架构来说,则不存在这样的问题。也就是说,采用硬件调度之后,GCN和SIMD可以允许选择不同的线程乱序执行,这些线程可以来自同一任务,也可以是不同任务。当然,这种“乱序”也不是绝对的,基本的流程还是要遵守的,比如各个线程之间的指令必须按顺序执行,不能打乱也不能分割。
以往的VLIW架构在并行任务处理方面处于劣势,并且很依赖编译器和API的支持,扩展到OpenCL也受到很大限制。经过硬件架构的调整,新的GCN架构在并行计算方面有了很大提高。编译压力减轻,硬件调度的加入使编译器摆脱了调度任务;其次是程序优化和支持语言扩充更见容易;最后是不用在生成VLIW指令和相关调度信息,新架构最底层的ISA也更加简单。
0人已赞
第1页:华硕最强HD7870 DCU II TOP测试第2页:GCN架构的精髓:更强大的多线程性能第3页:GCN架构的实际意义:GPU计算效能大增第4页:Radeon HD 7850定位、规格和特性解析第5页:超越公版 华硕HD7870 DCU II TOP规格解析第6页:测试平台和测试方法介绍第7页:基准测试:3DMark 11 Extreme第8页:基准测试:Heaven Benchmark 3.0第9页:游戏测试:《孤岛危机》第10页:游戏测试:《战地3》第11页:游戏测试:《地铁2033》第12页:游戏测试:《使命召唤:现代战争3》第13页:游戏测试:《孤岛惊魂2》第14页:超频性能测试第15页:温度和功耗测试第16页:总结:散热性能双重保障的性能级显卡