Ho un dataframe come questo:
A B C
0 1 0.749065 This
1 2 0.301084 is
2 3 0.463468 a
3 4 0.643961 random
4 1 0.866521 string
5 2 0.120737 !
chiamata
In [10]: print df.groupby("A")["B"].sum()
sarà di ritorno
A
1 1.615586
2 0.421821
3 0.463468
4 0.643961
Ora vorrei fare "lo stesso" per la colonna "C". Poiché quella colonna contiene stringhe, sum () non funziona (anche se potresti pensare che concatenerebbe le stringhe). Quello che mi piacerebbe davvero vedere è un elenco o un insieme di stringhe per ogni gruppo, ad es
A
1 {This, string}
2 {is, !}
3 {a}
4 {random}
Ho cercato di trovare modi per farlo.
Series.unique () ( http://pandas.pydata.org/pandas-docs/stable/generated/pandas.Series.unique.html ) non funziona, sebbene
df.groupby("A")["B"]
è un
pandas.core.groupby.SeriesGroupBy object
quindi speravo che qualsiasi metodo Series avrebbe funzionato. Qualche idea?
applyelambdas. Sono venuto qui chiedendomi perchépandaseffettivamente concatena e non restituisce un errore sulla somma delle stringhe.