בחירת תת־קבוצות של נתונים
שיעור 3 מתוך 14 בקורס מניפולציה של נתונים ב-R של Coddy.
בחירת תת־קבוצה של נתונים היא מיומנות חיונית ב־R, שמאפשרת לך לחלץ חלקים מסוימים מהנתונים שלך.
הפונקציה subset() מספקת דרך נוחה לבחור תת־קבוצות מתוך מסגרות נתונים.
df <- data.frame(
name = c("Alice", "Bob", "Charlie"),
age = c(25, 30, 35),
city = c("New York", "London", "Paris")
)# בחירת שורות משנה
result <- subset(df, age > 28)
print(result)פלט:
name age city
2 Bob 30 London
3 Charlie 35 Paris# בחירת תת־קבוצה של עמודות
result <- subset(df, select = c("name", "city"))
print(result)פלט:
name city
1 Alice New York
2 Bob London
3 Charlie Parisהשיעור הזה כולל חידון קצר. התחילו את השיעור כדי לענות עליו ולעקוב אחרי ההתקדמות.
השיעור הזה כולל חידון קצר. התחילו את השיעור כדי לענות עליו ולעקוב אחרי ההתקדמות.
השיעור הזה כולל חידון קצר. התחילו את השיעור כדי לענות עליו ולעקוב אחרי ההתקדמות.
אתגר
קלניתנה לך מסגרת נתונים שמכילה מידע על תלמידים. המשימה שלך היא לבצע את הפעולות הבאות:
- סנן את מסגרת הנתונים כך שתכלול רק תלמידים שגילם מעל 20 שנים.
- מתוך תת-הקבוצה הזאת, בחר רק את העמודות "name" ו-"score".
- חשב והדפס את הציון הממוצע של התלמידים האלה.
- זהה והדפס את שמו של התלמיד שקיבל את הציון הגבוה ביותר.
נסו בעצמכם
# קראו את הקלט
con <- file("stdin", "r")
input_data <- suppressWarnings(readLines(con))
# צרו מסגרת נתונים מהקלט
df <- read.csv(text = input_data, header = TRUE, stringsAsFactors = FALSE)
# TODO: כתבו את הקוד שלכם למטה
# 1. סננו את מסגרת הנתונים לתלמידים שגילם מעל 20
# 2. בחרו רק את העמודות "name" ו-"score"
# 3. חשבו את הציון הממוצע
# 4. מצאו את התלמיד בעל הציון הגבוה ביותר
# הדפיסו את התוצאות (עדכנו אותן לפי החישובים שלכם)
cat("Average score:", 0, "\n")
cat("Student with highest score:", "", "\n")כל השיעורים ביחידה מניפולציה של נתונים ב-R
1יסודות הנתונים
הבנת מבני נתוניםאינדוקס של Dataframeבחירת תת־קבוצות של נתוניםהמרת סוגי נתוניםאופרטור הצינור ב־Rתרגלו בעצמכם: קומפיילר R אונליין