Sum*_*uma 10 optimization x86 sse native simd
我在我的应用程序中广泛使用3D数学.通过将矢量/矩阵库转换为SSE,AltiVec或类似的SIMD代码,我可以实现多少加速?
Cra*_*rks 7
在我的经验,我通常会看到大约提高了3倍,采取的算法从的x87上交所和更好低于5倍的改善将VMX/AltiVec技术(因为具有与管线深度,日程安排等做复杂的问题).但是我通常只在我有数百或数千个数字操作的情况下这样做,而不是那些我一次只做一个矢量的情况.
归档时间:
17 年,11 月 前
查看次数:
4212 次
最近记录:
7 年,6 月 前