Pandas 간단 정리
T
TikaToka
help()
dir()import pandas as pdpd.Series([values], index=[index names], name='series name') # 1 column
pd.DataFrame({'key1': [values1], 'key2': [values2]}, index=[index names]) # n columnpd.read_csv('경로', index_col=int) # index_col은 특정 열을 index로 쓰고 싶을 때 사용review.country[int]
review['country'][int]review.iloc[0]
review.iloc[:, 0]review.loc[:, 'column name'
review.loc[:, [column names]]review.set_inex("title")review.country == 'Korea'
# 위를 활용하여
review.loc[reviews.country == 'Korea']
review.loc[(review.country == 'Korea') & (reviews.points >= 90)] # and 불가능
review.loc[(review.country == 'Korea') | (reviews.points >= 90)] # or 불가능
review.loc[review.country.isin(['Italy', 'France'])]
review.loc[review.price.notnull()]reviews['critic'] = 'everyone'review.score.mean()review.country.unique()review.country.value_counts()review.score.map(lambda x: x - review.score.mean()) # single valuedef remean_score(row):
row.score = row.score - review.score.mean()
return row
review.apply(remean_score, axis='columns') # multi valuereview_score_mean = review.score.mean()
review.points - review_score_meanreviews.country + " - " + reviews.region_1reviews.groupby('column name')
reviews.groupby([column names])reviews.reset_index()reviews.sort_values(by='column name')
reviews.sort_values(by=[column names])
reviews.sort_values(by='column name', ascending=False)review.sort_index()reviews.score.astype('dtype')reviews[pd.isnull(reviews.country)]reviews.region_2.fillna("value")
reviews.taster_twitter_handle.replace("@kerinokeefe", "@kerino")reviews.rename(columns={'points': 'score'}) # 이름을 지정
reviews.rename(index={0: 'firstEntry', 1: 'secondEntry'}) # idx를 지정\reviews.rename_axis("wines", axis='rows').rename_axis("fields", axis='columns') # axispd.concat([canadian_youtube, british_youtube])