סוגי אגרגציה שונים
שיעור 16 מתוך 19 בקורס ניתוח נתונים עם Pandas של Coddy.
כשמשתמשים ב־.sum() או בכל שיטה דומה אחרת, היא מחשבת את sum בכל העמודות המספריות. אפשר גם לציין איזו פעולת חישוב לבצע עבור כל עמודה:
df.groupby('column_name').agg({'column_1': 'sum', 'column_2': 'mean'})אתגר
קלקובץ ה-CSV visits.csv מכיל מידע על מספר הביקורים שהיו במיקום מסוים בזמן מסוים.
הנה 5 השורות הראשונות בקובץ:
location_id,visits,timestamp
8,1771,27498
9,4187,79919
0,4959,54228
6,7721,41588צרו מסגרת נתונים עם העמודות הבאות: sum_visits ו-mean_timestamp, ואת החישובים הסטטיסטיים המתאימים להן.
ודאו ש-
sum_visitsמופיעה לפניmean_timestamp..agg({column_1: '...', colunm_2: '...'})אינה זהה ל-.agg({column_2: '...', colunm_1: '...'}). הסיבה לכך היא שסדר העמודות הפוך.
שמרו את התוצאה ב-df.
נסו בעצמכם
# הספרייה pandas כבר יובאה בשם pd
df = pd.read_csv("./visits.csv")
# כתבו את הקוד שלכם למטה
כל השיעורים ביחידה ניתוח נתונים עם Pandas
3מניפולציה של נתונים עם Pandas
החזרת התוצאה המבוקשתסינון נתוניםהוספה ומחיקהשינוי נתוניםשינוי מחרוזותשינויים מותאמים אישיתתרגלו בעצמכם: קומפיילר Python אונליין