実現したいこと
以下のようなCSVファイルに、「最大値」「分散」の列を追加したい
0~12歳 13~18歳 19~30歳 31~45歳 46~65歳 65~100歳
k0 4 2 7 5 5 13
k1 1 3 3 6 8 12
k2 3 3 5 3 8 9
発生している問題・エラーメッセージ
半角¥が表示される
0~12歳 13~18歳 19~30歳 31~45歳 46~65歳 65~100歳 最大値 ¥
k0 4 2 7 5 5 13 65~100歳
k1 1 3 3 6 8 12 65~100歳
k2 3 3 5 3 8 9 65~100歳
分散
k0 14.400000
k1 16.300000
k2 7.366667
該当のソースコード
python
dff=pd.read_csv("age.csv") #最大値を含むカラム名dff['最大値'] =dff.idxmax(axis=1)#分散dff['分散']=dff.var(axis=1)
試したこと
CSVに書き込み、表示すると反映されないが、もう一度pd.read_csvで読み込みなおすと¥が表示されてしまう
python
dff.to_csv("age.csv",encoding='utf_8_sig',index=True)#ファイルに書き込みwith open('age.csv') as f: print(f.read()) #,0~12歳,13~18歳,19~30歳,31~45歳,46~65歳,65~100歳,最大値,分散k0,4,2,7,5,5,13,65~100歳,14.4k1,1,3,3,6,8,12,65~100歳,16.3k2,3,3,5,3,8,9,65~100歳,7.366666666666667

0 コメント