我有一個數據幀:設置數據幀的非空值有條件
0 1 2 3 4 y
35 NaN NaN NaN NaN 0.342153 0
40 NaN 0.326323 NaN NaN NaN 0
43 NaN NaN 0.290126 NaN NaN 0
49 NaN 0.326323 NaN NaN NaN 0
50 NaN 0.391147 NaN NaN NaN 1
和代碼生成它:
import pandas as pd
import numpy as np
nan = np.nan
df = pd.DataFrame(
{0L: {35: nan, 40: nan, 43: nan, 49: nan, 50: nan},
1L: {35: nan,
40: 0.32632316859446198,
43: nan,
49: 0.32632316859446198,
50: 0.39114724480578139},
2L: {35: nan, 40: nan, 43: 0.29012581014105987, 49: nan, 50: nan},
3L: {35: nan, 40: nan, 43: nan, 49: nan, 50: nan},
4L: {35: 0.34215328467153283, 40: nan, 43: nan, 49: nan, 50: nan},
'y': {35: 0, 40: 0, 43: 0, 49: 0, 50: 1}})
我需要分配一個值,使用下面的僞代碼的每一列:
column = 1 if column > threshold else 0 where column != NaN
我一直在使用索引看中做到這一點,像這樣嘗試:
df.ix[df[1].notnull(),1] = 1; df
0 1 2 3 4 y
35 NaN NaN NaN NaN 0.342153 0
40 NaN 1 NaN NaN NaN 0
43 NaN NaN 0.290126 NaN NaN 0
49 NaN 1 NaN NaN NaN 0
50 NaN 1 NaN NaN NaN 1
但是A)我不知道如何應用條件邏輯和B)我必須迭代地將邏輯應用到每列,而不是整個數據幀。
問:
如何申請條件邏輯的數據幀的非空值,保留其他字段的無效?