Saya punya Pandas DataFrame dan saya ingin menggabungkan kolom 'lat' dan 'long' untuk membentuk tupel.
<class 'pandas.core.frame.DataFrame'>
Int64Index: 205482 entries, 0 to 209018
Data columns:
Month 205482 non-null values
Reported by 205482 non-null values
Falls within 205482 non-null values
Easting 205482 non-null values
Northing 205482 non-null values
Location 205482 non-null values
Crime type 205482 non-null values
long 205482 non-null values
lat 205482 non-null values
dtypes: float64(4), object(5)
Kode yang saya coba gunakan adalah:
def merge_two_cols(series):
return (series['lat'], series['long'])
sample['lat_long'] = sample.apply(merge_two_cols, axis=1)
Namun, ini mengembalikan kesalahan berikut:
---------------------------------------------------------------------------
AssertionError Traceback (most recent call last)
<ipython-input-261-e752e52a96e6> in <module>()
2 return (series['lat'], series['long'])
3
----> 4 sample['lat_long'] = sample.apply(merge_two_cols, axis=1)
5
...
AssertionError: Block shape incompatible with manager
Bagaimana saya bisa mengatasi masalah ini?
list
. Ini seharusnya berhasil:df['new_col'] = list(zip(df.lat, df.long))
list(zip(df.lat, df.long))
dalam 124 md jauh lebih efisien daripadadf[['lat', 'long']].apply(tuple, axis=1)
dalam 14,2 dtk untuk 900k baris. Rasionya lebih dari 100.df['new_col'] = list(zip(df[cols_to_keep]))
tetapi terus mendapatkan kesalahan:Length of values does not match length of index
ada saran?df['new_col'] = list(zip(*[df[c] for c in cols_to_keep])
sumber
Panda memiliki
itertuples
metode untuk melakukan hal ini:sumber
Saya ingin menambahkan
df.values.tolist()
. (selama Anda tidak keberatan mendapatkan kolom daftar daripada tupel)sumber
%timeit df[['a', 'b']].values.tolist()
. Ini masih lebih cepat.