Pandas의 groupedby를 기반으로 데이터 프레임의 여러 문자열을 병합하고 싶습니다.
이것은 지금까지 내 코드입니다.
import pandas as pd
from io import StringIO
data = StringIO("""
"name1","hej","2014-11-01"
"name1","du","2014-11-02"
"name1","aj","2014-12-01"
"name1","oj","2014-12-02"
"name2","fin","2014-11-01"
"name2","katt","2014-11-02"
"name2","mycket","2014-12-01"
"name2","lite","2014-12-01"
""")
# load string as stream into dataframe
df = pd.read_csv(data,header=0, names=["name","text","date"],parse_dates=[2])
# add column with month
df["month"] = df["date"].apply(lambda x: x.month)
최종 결과가 다음과 같기를 바랍니다.
groupby를 사용하고 "텍스트"열에 문자열 연결을 적용하는 방법을 알지 못합니다. 어떤 도움을 주셔서 감사합니다!
pandas < 1.0
,.drop_duplicates()
예기치 않은 결과를 줄 수있는 인덱스를 무시합니다..agg(lambda x: ','.join(x))
대신을 사용하여이를 피할 수 있습니다.transform().drop_duplicates()
.