我在Nexus 10上移植和工作了几个基本算法(DCT/IDCT和其他几个算法)。由于这些算法是第一个实现的,所以它们的执行时间目前处于secs中,这是可以理解的。
但是,考虑到Renderscript的体系结构,我看到这些算法要么运行在CPU上,要么运行在GPU上,具体取决于其他并行应用程序活动。例如,在我的应用程序中,对于图像和该视图上的任何活动都有一个滚动视图,本质上将renderscript执行推送到CPU。如果没有活动,则该算法运行在GPU上。我通过ARM-DS5马里/A15痕迹看到了这一幕。
这种情况本身就是调试/调优的噩梦,因为算法运行在CPU (双核)和GPU (马里)上的性能增量为2秒,因此很难评估我对算法代码所做的性能改进。
有办法解决这个问题吗?一个可能的解决方案是至少有一个可调试的选项来选择renderscript代码的目标类型(ARM,GPU)?
发布于 2013-09-12 01:45:50
adb shell setprop debug.rs.default-CPU-driver 1这将强制在引用CPU实现上运行执行。没有任何条件可以将事情强制到GPU,因为许多条件都可能使运行时不可能这样做。
同样有用的是:
adb shell setprop debug.rs.max-threads 1它将使用的CPU核数限制为1(或设置为设备CPU计数的任何其他值)。
https://stackoverflow.com/questions/18753935
复制相似问题