Struktury danych w Pandas
Lekcja 2 z 19 w kursie Analiza danych z pandas w Coddy.
Pandas używa dwóch typów struktur danych: serii i ramek danych.
- Seria w Pandas przypomina jednowymiarową tablicę, która może przechowywać dane dowolnego typu. Na przykład seria może być listą liczb całkowitych
[4, 3, 8, 5]. - Ramka danych to dwuwymiarowa struktura danych, podobna do tabeli z wierszami i kolumnami. Wyobraź sobie arkusz kalkulacyjny lub tabelę SQL. Na przykład DataFrame może być zbiorem serii (kolumn), takich jak imię, wiek i wzrost.
Oswojenie się z Series i DataFrame pomoże Ci w pełni wykorzystać możliwości Pandas.
Aby utworzyć serię, użyj poniższego kodu:
import pandas as pd
temp = pd.Series([1, 2, ,3])Każda kolumna w ramce danych jest obiektem serii.
Aby przekształcić słownik w ramkę danych, musi on mieć odpowiedni format:
data = [{"col1": 22000,'col2': 1500.0},
{"col1": 25000,'col2': 3000.0},
{"col1": 23000,'col2': 2500.0}]
df = pd.DataFrame(data)Poprawne są również inne formaty.
Wyzwanie
ŁatwyUtwórz funkcję o nazwie dataframe_creator, która przyjmuje dane, tworzy z nich ramkę danych, a na koniec ją wyświetla.
Aby wyświetlić ramkę danych, napisz: print(df).
Spróbuj swoich sił
import pandas as pd
def dataframe_creator(data):
# Wpisz tutaj kodWszystkie lekcje w sekcji Analiza danych z pandas
4Analiza danych z Pandas
Statystyki opisoweGrupowanie i agregowanie danychRóżne sposoby agregacjiŁączenie i konkatenacja3Manipulowanie danymi za pomocą Pandas
Zwracanie żądanego wynikuFiltrowanie danychDodawanie i usuwanieModyfikowanie danychModyfikowanie ciągów znakówWłasne modyfikacjePoćwicz samodzielnie: Kompilator Python online