Menu
Coddy logo textTech

החזרת התוצאה המבוקשת

שיעור 8 מתוך 19 בקורס ניתוח נתונים עם Pandas של Coddy.

לפעמים אנחנו רוצים לענות על כמה שאלות, ולכן צריך לחלץ רק את העמודות הרלוונטיות.

להזכירכם, כדי לחלץ אובייקט סדרה של עמודה אחת:

column = df['col']

כדי לחלץ כמה עמודות, ציינו את שמות העמודות בתוך מערך (פעולה זו מחזירה מסגרת נתונים):

columns = df[['col1', 'col2', 'col3', ...]]

כדי לחלץ רק את השורות הרלוונטיות, אפשר להשתמש בחיתוך, בדיוק כמו ברשימות Python:

rows = df[row_index_start:row_index_end]

לדוגמה:

filtered_df = df[5:9]

filtered_df יכיל את השורות 5, 6, 7 ו-8.

עכשיו נמיין את התוצאה לפי הסדר הרצוי:

res = df.sort_values(by='column_name', ascending=True)
challenge icon

אתגר

קל

קובץ ה-CSV stats.csv מכיל מידע על נתונים סטטיסטיים.

  • חלצו רק את המזהים הזוגיים (even) (שורות עם המזהים 2, 4, 6, ...)
  • חלצו רק את העמודות  ID,  SKILL, ו-SKILL_POINTS.
  • שנו את שמות העמודות לאותיות קטנות.
  • מיינו את התוצאות לפי skill_points בסדר יורד.

שמרו את התוצאה במשתנה df.

זכרו כיצד חיתוך עובד כדי לחלץ רק את השורות הזוגיות.

נסו בעצמכם

import pandas as pd

df = pd.read_csv("./stats.csv")

כל השיעורים ביחידה ניתוח נתונים עם Pandas

תרגלו בעצמכם: קומפיילר Python אונליין