所以有件有趣的事情:
使用python 2.7:
我有一个大约5100个条目的数据,每个条目在一个名为“Tm”的栏目中有一个数字(熔点)。使用代码:
self.sort_df[['Tm']].mean(axis=0)我的意思是:
Tm 92.969204
dtype: float64这是没有意义的,因为没有一个条目的商标大于83。
.mean()不适用于这么多的值吗?我尝试过对数据集进行配对,它似乎适用于大约1,000个条目,但考虑到我有15万个完整的数据集需要一次运行,我想知道是否需要找到一种不同的方法来计算平均值。
发布于 2015-05-23 09:51:26
一个更易读的语法是:
sort_df['Tm'].mean()尝试执行sort_df['Tm'].value_counts()或sort_df['Tm'].max()以查看存在哪些值。一些意料之外的值一定是悄悄上升的。
无论大小如何,.mean函数都会给出精确的结果。
https://stackoverflow.com/questions/30411203
复制相似问题