在步入统一渲染架构的新纪元,NVIDIA和AMD在GPU设计策略上呈现出鲜明的对比。NVIDIA注重提升Shader的运行频率和效率,而AMD则坚持增加流处理器数量,各有千秋。NVIDIA的优势在于,其GPU中的每个流处理器都配备了完整的ALU功能,能够独立高效地执行指令。相比之下,AMD的GPU每个流处理器固定为5个单元,对于处理4D指令,可能需要5个单元协作才能完成,这就可能导致资源的浪费,因为其中四个单元缺乏独立的ALU功能,无法单独执行复杂的运算。尽管AMD的流处理器数量多,但在浮点运算能力上,它却展现出明显的优势。在科学计算这类广泛应用GPGPU的领域,ATI的GPU理论上更适合与CPU协同工作,展现出更强的运算能力。总结来看,尽管N卡的单个流处理器效能相当于五个AMD的,如HD5970的3200个流处理单元相当于NVIDIA的640个流处理器,但NVIDIA的优化设计在执行效率上可能更胜一筹,而AMD的优势则在于浮点运算的密集处理能力。