图形与计算那些事 AMD次世代架构解析
分享
最后,再来强调一下AMD抛弃5D/4D VLIW改用全新GCN架构的意义
理想状态下毫不相干的四组线程执行情况
在VLIW的理想情况下,4个线程分别各自独立且毫不相关,可以看到新架构和VLIW的执行情况和类似,理论上效率都是100%。
非理想状态下,条件相关线程延迟执行
但对于VLIW架构来说,不理想的情况就是遇到相关的指令流,比如两个绿色线程,前三个线程可在一个周期内执行,最下方的蓝色只能独立执行。而对于新架构来说,则不存在这样的问题。也就是说,采用硬件调度之后,GCN和SIMD可以允许选择不同的线程乱序执行,这些线程可以来自同一任务,也可以是不同任务。当然,这种“乱序”也不是绝对的,基本的流程还是要遵守的,比如各个线程之间的指令必须按顺序执行,不能打乱也不能分割。
以上就是AMD官方提供的数据,HD7970的理论运算能力相比HD6970提升不过30%,但在GPU计算应用当中的性能提升相当显著,可达两倍以上!尤其在AES加密解密算法中,速度达到了4倍以上,架构的威力可见一斑!
HD7900会在WinZIP当中有更好的加密压缩解压性能
高清视频实时防抖处理
AMD在努力:支持GPU计算的软件越来越多
以往的VLIW架构在并行任务处理方面处于劣势,并且很依赖编译器和API的支持,扩展到OpenCL也受到很大限制。经过硬件架构的调整,新的GCN架构在并行计算方面有了很大提高。编译压力减轻,硬件调度的加入使编译器摆脱了调度任务;其次是程序优化和支持语言扩充更见容易;最后是不用在生成VLIW指令和相关调度信息,新架构最底层的ISA也更加简单。
2人已赞
第1页:Radeon是一款好显卡,但不是颗好GPU第2页:成也微软败也微软:XBOX360阻碍显卡/游戏发展第3页:从X1900XTX谈起:用3:1黄金架构做计算第4页:HD2900XT走向不归路:超长指令集的弊端第5页:HD4870的救赎:暴力扩充流处理器第6页:HD5870的辉煌:在错误的道路上越走越远第7页:HD6870的一小步:双超线程分配处理器第8页:HD6970昙花一现:北方群岛5D改4D返璞归真第9页:GPU的一大步:NVIDIA G80图形架构解析第10页:真正的并行计算架构:GT200只为计算优化第11页:DX11与并行计算的完美结合:GF100/110的野心第12页:HD7970华丽登场:曲面细分性能大幅提升第13页:GCN架构的精髓:流处理器完全重新设计第14页:GCN架构的缓存:照搬GF100的设计?第15页:Tihiti其他方面的改进:AMD真是个激进派第16页:GCN架构的真正意义:GPU计算效能大增第17页:全文总结:浴火重生,新的开始新的期待