החזרת התוצאה המבוקשת
שיעור 8 מתוך 19 בקורס ניתוח נתונים עם Pandas של Coddy.
לפעמים אנחנו רוצים לענות על כמה שאלות, ולכן צריך לחלץ רק את העמודות הרלוונטיות.
להזכירכם, כדי לחלץ אובייקט סדרה של עמודה אחת:
column = df['col']כדי לחלץ כמה עמודות, ציינו את שמות העמודות בתוך מערך (פעולה זו מחזירה מסגרת נתונים):
columns = df[['col1', 'col2', 'col3', ...]]כדי לחלץ רק את השורות הרלוונטיות, אפשר להשתמש בחיתוך, בדיוק כמו ברשימות Python:
rows = df[row_index_start:row_index_end]לדוגמה:
filtered_df = df[5:9]filtered_df יכיל את השורות 5, 6, 7 ו-8.
עכשיו נמיין את התוצאה לפי הסדר הרצוי:
res = df.sort_values(by='column_name', ascending=True)אתגר
קלקובץ ה-CSV stats.csv מכיל מידע על נתונים סטטיסטיים.
- חלצו רק את המזהים הזוגיים (
even) (שורות עם המזהים2,4,6, ...) - חלצו רק את העמודות
ID,SKILL, ו-SKILL_POINTS. - שנו את שמות העמודות לאותיות קטנות.
- מיינו את התוצאות לפי
skill_pointsבסדר יורד.
שמרו את התוצאה במשתנה df.
זכרו כיצד חיתוך עובד כדי לחלץ רק את השורות הזוגיות.
נסו בעצמכם
import pandas as pd
df = pd.read_csv("./stats.csv")כל השיעורים ביחידה ניתוח נתונים עם Pandas
3מניפולציה של נתונים עם Pandas
החזרת התוצאה המבוקשתסינון נתוניםהוספה ומחיקהשינוי נתוניםשינוי מחרוזותשינויים מותאמים אישיתתרגלו בעצמכם: קומפיילר Python אונליין