我有一个csv文件,它包含许多记录,还有许多其他csv文件,它们持有相同的记录,但它们的值不同。我想分析和得到一些有用的信息,从这些csv文件,但不知道如何做呢?该怎么做呢?
csv文件就像
Compony name,DCP,OpenMarket,HIGH,LOW,CURRENT_MARKET,CHANGE,VOLUME
Company Moon, 8.07, 9.07, 9.07, 7.80, 8.22, 0.15, 4547500
Company Sun, 7.07, 6.07, 5.07, 3.80, 7.22, 0.10, 1233333
.
.
.这是一个csv文件,其中包含了一些公司在股票市场的数据。另一个csv文件保存相同的公司数据,但具有不同的值。我想根据他们的变化,数量和其他的支持来获得信息,以知道哪家公司进展良好。
发布于 2022-10-19 06:16:34
使用熊猫时,如果您想按单元格区分单元格,并且假设这两个文件的行/列数相同,我将执行以下操作:
import pandas as pd
df1 = pd.read_csv('file1.csv')
df2 = pd.read_csv('file2.csv')
# join the 2 dataframes to get a single dataframe
df = df1.join(df2, rsuffix='_2')
# columns will now be A,B,C and A_2, B_2, C_2 respectively
# check for diff with
df['A-diff'] = df['A'] - df['A_2']
# ...
# or to do it all:
for col in df1.columns:
df[f'{col}-diff'] = df[col] - df['{col}_2']
#df['<column name>-diff'] has the diff for each column我展示了一个简单的减法操作,但是您可以对这2列做任何您想做的事情。重点是在一个数据文件中获取合并的值,以便对它们进行操作。
参考文献:https://pandas.pydata.org/docs/reference/api/pandas.DataFrame.join.html
https://stackoverflow.com/questions/74119152
复制相似问题