Menu
Coddy logo textTech

Modyfikowanie ciągów znaków

Lekcja 12 z 19 w kursie Analiza danych z pandas w Coddy.

Praca z ciągami znaków jest nieco trudniejsza, ponieważ nie możesz po prostu dodać 5 ani porównać ich z liczbą. Do tego Pandas ma specjalne narzędzie .str, które pozwala nam używać wielu metod obsługiwanych przez ciągi znaków w Pythonie, takich jak: .upper(), .lower(), .split() .len() itd.

Aby zamienić ciągi znaków w kolumnie na wielkie litery:

df["existing_column"] = df["existing_column"].str.upper()

Aby połączyć kilka metod, musimy użyć kilku .str, ponieważ każda metoda zwraca obiekt typu seria:

.str.upper().str.split().str.lower()...

Aby utworzyć kolumny first_name i last_name z full_name:

df["first_name"] = df["full_name"].str.split(" ").str[0]
df["last_name"] = df["full_name"].str.split(" ").str[1] 
challenge icon

Wyzwanie

Łatwy

Plik CSV stats.csv zawiera informacje o statystykach.

Oto pierwszych 5 wierszy pliku:

ID,COUNTRY,COLOR,SKILL,SKILL_POINTS,UTILIZATION,IS_VALID,CATEGORY
1,France,Signal violet,marksmanship,14,0.1924,1,SHOW
2,Solomon Islands,Pearl violet,crocheting,4,0.6108,1,TREE
3,Germany,Bottle green,calligraphy,12,0.88646,0,SHOW
4,Mauritania,Fawn brown,paper cutting,9,0.058,1,JAPE
  • Zmień kolumnę COLOR tak, aby zawierała tylko ostatnie słowo z kolumny COLOR.
  • Dodaj kolumnę o nazwie COUNTRY_LENGTH, która zawiera liczbę znaków w kolumnie COUNTRY  .
  • Odfiltruj wszystkie wiersze, w których kolumna SKILL zawiera tylko jedno słowo (na przykład "wood chopper" składa się z dwóch słów).

Zapisz wynik w zmiennej df.

Spróbuj swoich sił

# pandas jako pd jest już zaimportowany
df = pd.read_csv("./stats.csv")
# Napisz swój kod poniżej

Wszystkie lekcje w sekcji Analiza danych z pandas

Poćwicz samodzielnie: Kompilator Python online