Menu
Coddy logo textTech

Poznawanie DataFrame

Lekcja 4 z 19 w kursie Analiza danych z pandas w Coddy.

Ramki danych stanowią podstawę biblioteki Pandas. Ramka danych to dwuwymiarowa, oznaczona etykietami struktura danych, której kolumny mogą mieć różne typy, w tym całkowity, zmiennoprzecinkowy, obiektowy i inne.
W skrócie, ramka danych przypomina tabelę z danymi. Możesz wyobrazić ją sobie jako arkusz kalkulacyjny lub tabelę SQL. Wiersze odpowiadają poszczególnym przykładom wejściowym (obserwacjom), a kolumny reprezentują cechy danych. Za pomocą ramek danych możemy przekształcać, analizować, grupować i wstępnie przetwarzać dane.

Pracując z nową ramką danych, musimy dowiedzieć się, jakie są jej kolumny, jakie mają typy danych, ile ma wierszy, jakiego rodzaju dane przechowuje i tak dalej. Oto kilka funkcji, które pozwalają szybko uzyskać informacje o danych:

  • head(n): Pokazuje pierwsze n wierszy
  • head(): Pokazuje pierwsze 5 wierszy
  • describe(): Zwraca statystyki opisowe, takie jak średnia, maksimum, minimum itd.
  • info(): Zwraca podsumowanie wszystkich cech (kolumn).
  • shape:kształt ramki danych (liczba wierszy i kolumn). To właściwość, a nie metoda.
  • tail(n): Pokazuje ostatnie n wierszy
  • tail(): Pokazuje pierwsze 5 wierszy
challenge icon

Wyzwanie

Łatwy

W tym wyzwaniu masz plik CSV o nazwie brands.csv.

Zanim cokolwiek zrobisz, użyj .read_csv(), aby przekształcić plik w ramkę danych.

Utwórz funkcję o nazwie information, która przyjmuje ciąg znaków mogący zawierać jedną z następujących wartości:

  • "head"
  • "describe"
  • "info"
  • "shape"
  • "tail"

Funkcja wypisze odpowiedni wynik ramki danych.

Spróbuj swoich sił

import pandas as pd
def information(action):
    df = pd.read_csv("brands.csv")
    # Wpisz kod tutaj

Wszystkie lekcje w sekcji Analiza danych z pandas

Poćwicz samodzielnie: Kompilator Python online