Modyfikowanie ciągów znaków
Lekcja 12 z 19 w kursie Analiza danych z pandas w Coddy.
Praca z ciągami znaków jest nieco trudniejsza, ponieważ nie możesz po prostu dodać 5 ani porównać ich z liczbą. Do tego Pandas ma specjalne narzędzie .str, które pozwala nam używać wielu metod obsługiwanych przez ciągi znaków w Pythonie, takich jak: .upper(), .lower(), .split() .len() itd.
Aby zamienić ciągi znaków w kolumnie na wielkie litery:
df["existing_column"] = df["existing_column"].str.upper()Aby połączyć kilka metod, musimy użyć kilku .str, ponieważ każda metoda zwraca obiekt typu seria:
.str.upper().str.split().str.lower()...Aby utworzyć kolumny first_name i last_name z full_name:
df["first_name"] = df["full_name"].str.split(" ").str[0]
df["last_name"] = df["full_name"].str.split(" ").str[1] Wyzwanie
ŁatwyPlik CSV stats.csv zawiera informacje o statystykach.
Oto pierwszych 5 wierszy pliku:
ID,COUNTRY,COLOR,SKILL,SKILL_POINTS,UTILIZATION,IS_VALID,CATEGORY
1,France,Signal violet,marksmanship,14,0.1924,1,SHOW
2,Solomon Islands,Pearl violet,crocheting,4,0.6108,1,TREE
3,Germany,Bottle green,calligraphy,12,0.88646,0,SHOW
4,Mauritania,Fawn brown,paper cutting,9,0.058,1,JAPE- Zmień kolumnę
COLORtak, aby zawierała tylko ostatnie słowo z kolumnyCOLOR. - Dodaj kolumnę o nazwie
COUNTRY_LENGTH, która zawiera liczbę znaków w kolumnieCOUNTRY. - Odfiltruj wszystkie wiersze, w których kolumna
SKILLzawiera tylko jedno słowo (na przykład "wood chopper" składa się z dwóch słów).
Zapisz wynik w zmiennej df.
Spróbuj swoich sił
# pandas jako pd jest już zaimportowany
df = pd.read_csv("./stats.csv")
# Napisz swój kod poniżej
Wszystkie lekcje w sekcji Analiza danych z pandas
4Analiza danych z Pandas
Statystyki opisoweGrupowanie i agregowanie danychRóżne sposoby agregacjiŁączenie i konkatenacja3Manipulowanie danymi za pomocą Pandas
Zwracanie żądanego wynikuFiltrowanie danychDodawanie i usuwanieModyfikowanie danychModyfikowanie ciągów znakówWłasne modyfikacjePoćwicz samodzielnie: Kompilator Python online