我想对视频帧做一些检测和分类工作,但是视频中有太多的帧需要处理,所以我想找出哪些帧包含对象,哪些帧没有意义(不包含对象或脸),这样就可以通过检测较少的帧来节省一些时间。
我已经测试了Gist和SVM,试图将包含狗的图像(Pascal voc)与森林场景图像(15个场景数据集)分开,但是测试数据的准确率很低(不到50%)。
是否有适合这项任务的其他特征或算法?另外,是否有适合此任务的数据集?
发布于 2015-08-14 07:46:13
您可以研究视觉显着性检测方法。如果有显著的集群,这些帧可能包含对象。
https://stackoverflow.com/questions/32002564
复制相似问题